Dalam sebuah wawancara World Science Festival pada 2 Oktober, matematikawan Tristan Buckmaster menceritakan hasil yang dibuat dengan AI dan ia anggap benar, tetapi sulit dibaca oleh matematikawan lain. Kisahnya memberi pertanyaan yang lebih spesifik pada pengumuman Navier–Stokes baru-baru ini: bagaimana komunitas riset memeriksa argumen formal ketika penjelasan yang mudah dibaca masih memerlukan pekerjaan lanjutan?

Buckmaster membahas karyanya bersama Levent Alpöge tentang persamaan Euler tiga dimensi dengan gaya pemaksa yang mulus. Hasil mereka berbeda dari klaim OpenAI pada 8 September tentang persamaan Navier–Stokes dengan gaya pemaksa yang mulus. Navier–Stokes mencakup viskositas; Euler tidak. OpenAI merilis makalah dan formalisasi Lean untuk klaimnya tentang keruntuhan dalam waktu terbatas. Lembaga yang mengelola Millennium Prize belum mengumumkan penghargaan.

Perubahan besar

  • Apa yang berubah:Buckmaster menceritakan langsung pengalamannya menggunakan argumen yang dihasilkan AI dan Lean untuk menetapkan hasil forced-Euler yang terpisah, serta pekerjaan yang masih diperlukan untuk menjelaskan bukti semacam itu kepada matematikawan.
  • Mengapa ini penting:Pemeriksaan formal dapat memastikan bahwa argumen yang dikodekan mengikuti definisi dan dependensi tertentu. Matematikawan juga perlu memahami apa yang dinyatakan teorema, bagaimana gagasannya bekerja, dan karya terdahulu siapa yang digunakannya.
  • Yang perlu dicermati:Evaluasi Clay atas klaim Navier–Stokes OpenAI, uraian bukti yang mudah dibaca, dan pembahasan publik tentang kepengarangan serta akses akan menunjukkan bagaimana hasil ini dinilai. Keyakinan Buckmaster terhadap hasil itu adalah pandangan seorang ahli, bukan keputusan penghargaan.

Argumen yang sudah diperiksa tetap memerlukan penjelasan

Dalam wawancara, Buckmaster mengatakan bukti pertama untuk hasil Euler-nya yang dibuat AI memadukan gagasan berguna dengan perhitungan yang tidak relevan dan uraian yang sulit dibaca. Timnya mula-mula meminta agen lain memeriksa langkah-langkah tertentu, lalu mengubah argumen itu ke Lean untuk pemeriksaan formal. Ia mengatakan bukti yang dihasilkan benar meski penyajiannya buruk. Kisah itu merujuk pada karyanya tentang Euler; jangan menafsirkannya sebagai verifikasi independen atas setiap bagian dari makalah Navier–Stokes OpenAI yang berbeda.

Perbedaan ini penting dalam praktik. Lean memeriksa pernyataan yang diformalkan secara tepat dalam lingkungan pembuktian tertentu. Dengan sendirinya, Lean tidak membuat argumen panjang mudah dibaca oleh peneliti yang ingin menggunakan kembali metodenya. Buckmaster mengatakan kepada Brian Greene bahwa sistem AI lain dapat mengurai bagian yang hampir tak terbaca baginya, dan meminta AI menerjemahkannya ke dalam bahasa matematika biasa menjadi bagian dari pekerjaan. Ia juga mengatakan masih dapat memahami gagasan dalam argumen Navier–Stokes meskipun PDF terbitannya sulit dibaca. Ini adalah penilaian yang ia laporkan, bukan audit bukti BIG CHANGE; kami tidak menjalankan berkas Lean atau menelaah salah satu teorema.

Laporan NYU Courant pada 14 September menyebut pencapaian Buckmaster dan Alpöge sebagai hilangnya keteraturan dalam waktu terbatas pada Euler 3D dengan gaya pemaksa yang mulus dan data awal berenergi terbatas. Laporan itu menyebut tiga makalah kolaborasi diformalkan dengan Lean dan menempatkan hasilnya dalam strategi yang dimulai Diego Córdoba dan Luis Martínez-Zoroa. Rincian ini penting saat memberi pengakuan: bukti yang dibuat model dapat memperluas jalur matematika yang sudah ada tanpa menghapus orang-orang yang membangunnya.

Dua hasil dalam rangkaian yang bergerak cepat

OpenAI mengatakan sistem agennya mula-mula menghasilkan hasil Euler tanpa gaya pemaksa lalu menggunakan jalur itu dalam konstruksi Navier–Stokes yang terpisah. Pengumumannya mengakui prioritas hasil Euler dengan gaya pemaksa dari Buckmaster dan Alpöge, sembari menyatakan bahwa bukti OpenAI dikembangkan secara independen. Dalam wawancara, Buckmaster menyebut mekanisme matematikanya saling terkait dan mengatakan OpenAI menambahkan gagasan pusaran yang runtuh untuk menangani viskositas. Berbagai keterangan sepakat bahwa klaim tersebut melibatkan persamaan dan langkah pembuktian yang berbeda; semuanya belum menjawab setiap pertanyaan tentang kronologi atau atribusi intelektual.

Pernyataan European Mathematical Society menyambut pengumuman itu sambil menekankan penelitian sebelumnya dan meminta perhatian pada kepengarangan, pengakuan, dan akses ke model internal. Tanggapan Clay pada 11 September menyatakan bahwa masalah Navier–Stokes tampaknya telah diselesaikan dan bahwa penilaian atas pencapaian serta pemberian pengakuan akan dilakukan dengan sengaja tanpa tergesa-gesa. Buckmaster mengatakan kepada Greene bahwa ia percaya OpenAI punya solusi. Pembaca dapat menerima kedua pernyataan sekaligus: penilaian positif seorang spesialis dan evaluasi institusi yang masih berlangsung.

Baru-baru ini, OpenAI menarik tiga naskah matematika lainnya merupakan peristiwa terpisah. Kesalahan tanda yang mereka laporkan menjadi alasan untuk memeriksa setiap klaim secara terpisah; hal itu bukan bukti bahwa bukti Navier–Stokes memuat kesalahan yang sama. Panduan pemeriksaan repositori BIG CHANGE menjelaskan cara menemukan versi manuskrip dan artefak bukti, sementara opini kami tentang kapasitas peninjauan berpendapat bahwa penjelasan dan pemeriksaan memerlukan dukungan khusus. Artikel Navier–Stokes sebelumnya mencatat awal rangkaian ini. Wawancara ini menambahkan kisah seorang matematikawan aktif tentang apa yang terjadi setelah sistem AI menghasilkan argumen.

Untuk klaim sepenting ini, publikasi berguna berikutnya adalah uraian akurat yang dapat dibaca manusia, artefak formal yang bisa diperiksa, dan tanggapan matematis independen. Masing-masing punya fungsi berbeda. Kecepatan menghasilkan kandidat bukti membuat pekerjaan tersebut makin mendesak, sementara proses yang dinyatakan Clay menyediakan ruang untuk mengerjakannya dengan cermat.

Sumber dan bacaan lanjutan