Teknologi dan inovasi

AI mengubah teorema terakhir Fermat menjadi pembuktian Lean terbesar sejauh ini

Teorema terakhir Fermat untuk pertama kalinya diterjemahkan menjadi kode yang dapat diperiksa komputer, menghasilkan pembuktian formal sepanjang 13 juta baris hanya dalam 11 hari. Sekelompok agen AI mengembangkan sekitar 29.500 teorema perantara yang diperlukan untuk menyelesaikan pekerjaan tersebut dalam Lean, bahasa pemrograman yang dirancang untuk memverifikasi logika matematika.

Pencapaian ini tidak menggantikan atau memperluas pembuktian yang diselesaikan oleh Andrew Wiles dan Richard Taylor pada 1990-an. Sebaliknya, pencapaian ini mengubah penalaran yang sudah mapan tersebut menjadi bentuk yang dapat diperiksa komputer langkah demi langkah. Teorema itu menyatakan bahwa tidak ada bilangan bulat yang dapat memenuhi aⁿ + bⁿ = cⁿ ketika n lebih besar dari 2.

Para ahli manusia sesekali memberikan arahan umum. Agen-agen tersebut pada awalnya kesulitan berkoordinasi, tetapi berhasil setelah menggunakan Prove2Me, alat kolaborasi yang membantu mereka melacak tugas yang telah selesai dan memilih pekerjaan berikutnya. Matematikawan Kevin Buzzard mengompilasi kode yang dihasilkan dan menjalankan pemeriksaan standar Lean, lalu menyimpulkan bahwa kode itu benar-benar mengembangkan kerangka matematika yang diperlukan.

Formalisasi ini berukuran lebih dari lima kali ukuran Mathlib, pustaka bersama utama untuk matematika dalam Lean. Skalanya menunjukkan bahwa AI mungkin segera membantu mengubah bagian-bagian besar dari literatur matematika menjadi kode yang dapat diverifikasi, meskipun meninjau keluaran sebesar itu dan membuatnya dapat dipahami manusia tetap menjadi tantangan besar.

Sumber

  1. NatureAnthropic AI 'formalizes' proof of Fermat's last theorem in just 11 days
  2. New ScientistFermat's last theorem formalised by AI agents in just 11 days | New Scientist
  3. The Next WebClaude formalised Fermat's Last Theorem in 11 days

Catatan peliputan

Asal informasi ini

Anthropic's 4 September announcement

Nature secara eksplisit menyatakan bahwa Anthropic mengumumkan terobosan tersebut pada 4 September, lalu melengkapi pengumuman itu dengan komentar Alex Kontorovich, Kevin Buzzard, dan Daniel Litt.

Anthropic's research post

New Scientist secara eksplisit mengutip unggahan blog Anthropic sebagai sumber mengenai proses otonom selama 11 hari dan alur kerja agen. The Next Web berulang kali mengatribusikan penggunaan token, percobaan yang gagal, instruksi manusia, dan rincian Prove2Me kepada Anthropic.

Kevin Buzzard's blog

The Next Web menyatakan bahwa Kevin Buzzard mengompilasi kode Anthropic, menjalankan pemeriksa standar, dan menerbitkan tanggapannya di blog pribadinya, yang dikutip dan dirangkum dalam artikel tersebut.