Bukti yang dihasilkan AI sering dikonfirmasi menggunakan proses yang disebut formalisasi. OpenAI sepertinya membuat kesalahan halus saat mempublikasikan bukti masalah Navier-Stokes, sekelompok matematikawan mengklaim. Kesalahan ini tidak berarti bukti salah atau OpenAI belum tepat menyelesaikan masalah, tetapi mempertanyakan apakah hasil matematika yang dihasilkan model AI selalu dapat diandalkan.
"Semua bukti ini yang dihasilkan oleh model bahasa besar harus dibaca oleh manusia, dan ini menimpa beban besar extra bagi matematikawan", kata Anders Hansen di University of Cambridge. Pada 8 September, OpenAI mengumumkan bahwa telah menemukan solusi masalah Navier-Stokes, salah satu masalah terbuka paling terkenal dalam matematika. Ia menerbitkan bukti dalam dua versi – satu ditulis dalam "natural language" dan yang lain dalam kode komputer Lean.
Masalahnya, kata Hansen dan timnya, dua bukti tidak sesuai. "Proses formalisasi ini mencoba menggantikan review sesama", kata anggota tim Fabian Circelli, juga di University of Cambridge. "Peer review berarti orang melihat bukti. Tapi yang kita tunjukkan dalam paper ini adalah bahwa jenis AI auto-formalisasi ini tidak dapat layanan yang sama."
Klaim khusus tim ini bergantung pada bagian-bagian bukti yang disebut Lemma 8.6. Dalam bukti bahasa alami, persamaan memerlukan nilai di bawah m + 4, sementara dalam bukti Lean nilai setara di bawah m + 5, yang lebih lemah secara matematis. OpenAI mengatakan ke New Scientist bahwa sadar dengan ketidakseimpangan ini dan ini tidak berarti salah satu bukti tidak valid.
Sumber: Hacker News · Diringkas oleh HeadlinesBriefing