Bukti Matematika OpenAI Dinilai Belum Memenuhi Standar Peneliti
CIANJUR.CO - OpenAI merilis ratusan hasil yang diklaim sebagai solusi untuk sejumlah persoalan matematika paling sulit di dunia. Namun, pedoman kelompok peneliti matematika yang sebelumnya diajak berkonsultasi oleh laboratorium kecerdasan buatan itu belum sepenuhnya dipenuhi. Perhatian utama kelompok tersebut adalah perlunya pemahaman manusia terhadap hasil matematika, bukan hanya keluaran model yang tampak sebagai bukti.
Berdasarkan laporan TechCrunch AI, OpenAI menyatakan telah berkonsultasi dengan sekelompok matematikawan berpengaruh agar rilis terbarunya tidak mengulang kontroversi yang muncul ketika salah satu modelnya menyelesaikan persoalan lama di bidang tersebut. Meski sejumlah prinsip diikuti, penilaian atas bukti-bukti terbaru menunjukkan masih ada celah dalam keterbukaan proses dan keterlibatan manusia.
Kelompok penasihat yang dimaksud bernama Advisory Group on Mathematics and Artificial Intelligence (AGMAI). Kelompok ini berada di bawah naungan Institute for Advanced Studies di Princeton University dan beranggotakan sembilan peneliti terkemuka dari berbagai institusi di seluruh dunia. Pada akhir September, AGMAI menerbitkan pedoman bagi laboratorium AI terdepan yang berupaya menyelesaikan persoalan matematika.
Dalam pernyataan mengenai kumpulan bukti terbaru OpenAI, AGMAI menyebut bahwa penilaian akhir berada pada komunitas matematika. “it is ultimately up to the mathematical community to assess the extent to which our recommendations were followed successfully,” demikian pernyataan kelompok itu. AGMAI tidak memberikan evaluasi terperinci kepada TechCrunch ketika dimintai tanggapan lebih jauh mengenai rilis tersebut.
Baca juga: California Batasi Keputusan Pemecatan yang Sepenuhnya Diserahkan kepada AI
Salah satu rekomendasi awal AGMAI adalah “to stop testing advanced mathematical problems on proprietary models”. Namun, OpenAI secara jelas menyatakan bahwa mereka sedang mengevaluasi model proprieternya dengan menggunakan persoalan riset terbuka di bidang matematika. Perbedaan ini menjadi salah satu contoh bahwa sebagian praktik dalam rilis tersebut tidak sejalan dengan arahan kelompok penasihat.
Di sisi lain, OpenAI dinilai telah mengikuti beberapa prinsip AGMAI. Laboratorium itu merilis hasil secepat mungkin dan menyertakan informasi tentang cara model mencapai kesimpulannya. Akan tetapi, keterangan mengenai proses berpikir model tidak tersedia secara merata. Dari 719 manuskrip yang dirilis, hanya sepuluh yang menyertakan chain of thought atau rangkaian penalaran model.
AGMAI juga menyarankan agar bukti yang tidak dipahami manusia diformalkan. Proses formalisasi dimaksudkan untuk menyajikan bukti dalam bentuk yang dapat diperiksa secara lebih sistematis. Namun, hanya 42 persen dari bukti yang dirilis OpenAI yang belum melalui proses tersebut. Angka ini memperlihatkan bahwa status pemeriksaan formal tidak seragam di seluruh kumpulan hasil yang dipublikasikan.
Baca juga: AI Dinilai Belum Menuntaskan Masalah Modernisasi Sistem IT Lama
Masalah yang lebih mendasar, menurut laporan itu, adalah belum jelas apakah OpenAI mengambil tanggung jawab untuk memastikan pemahaman manusia menyusul setelah bukti dirilis. AGMAI menyarankan agar perusahaan membantu mendanai pekerjaan matematikawan manusia yang dibutuhkan untuk memberi makna pada solusi tersebut. Tanpa pemahaman dan keterlibatan ahli, hasil yang dihasilkan model berisiko tidak dapat dibahas dan dinilai secara memadai dalam komunitas matematika.
Matematikawan Terence Tao, yang sebelumnya mengkritik pendekatan OpenAI, menyoroti risiko ketika orang yang meminta AI menyelesaikan persoalan tidak memiliki minat lebih luas pada bidang matematika setelah target awal tercapai. Ia menulis bahwa persoalan dapat diselesaikan secara mandiri oleh pengguna AI yang “have no interest in the broader field itself once their initial target is ‘solved’”. Menurut Tao, mereka juga dapat tidak cukup memahami keluaran AI untuk menjawab pertanyaan, mempresentasikan hasil, atau berinteraksi dengan peneliti lain.
Perdebatan tersebut mendapat contoh konkret dari sebuah makalah yang diterbitkan pekan itu oleh matematikawan dari University of Cambridge dan King’s College di London. Makalah itu mempertanyakan pendekatan laboratorium AI terdepan dalam menangani tantangan matematika. Dalam proses yang lazim dipakai model, sistem mula-mula menghasilkan penjelasan dalam bahasa alami, lalu berusaha menyatakannya kembali dalam Lean, bahasa pemrograman yang secara teori dapat menguji ketepatan bukti dengan mengompilasinya sebagai kode.
Baca juga: TechCrunch Disrupt 2026 Bahas Peluang di Balik Infrastruktur AI
Para penulis makalah menemukan setidaknya dua ketidaksesuaian antara bukti berbahasa alami dan kode Lean yang mendasari solusi OpenAI untuk persoalan turunan persamaan Navier-Stokes, yang menggambarkan perilaku kompleks fluida. Temuan itu tidak serta-merta membuktikan bahwa salah satu dari kedua solusi tersebut keliru. Namun, perbedaan tersebut memunculkan pertanyaan apakah model dapat diandalkan untuk memformalkan solusinya sendiri tanpa campur tangan manusia.
AGMAI sebelumnya meminta OpenAI menyertakan metadata yang dapat dibaca mesin untuk menghubungkan artefak bahasa alami dengan artefak formal. Informasi penghubung tersebut tidak disertakan dalam rilis yang dibahas. Penulis makalah “lost in translation” memperingatkan bahwa bukti bahasa alami OpenAI dan bukti Lean yang diformalisasi secara otomatis tidak semestinya langsung dipercaya tanpa penelaahan sejawat dan pemeriksaan seperti yang diterapkan pada bukti lain.
Dalam matematika, penemuan hasil baru oleh manusia umumnya disertai tanggung jawab atas hasil tersebut serta keterlibatan dengan komunitas melalui makalah, presentasi, dan seminar. Proses itu membantu memperdalam pemahaman, menemukan strategi yang dapat dipakai untuk persoalan lain, serta memungkinkan pengetahuan baru diterapkan di bidang praktis. Menurut profesor matematika Harvard University Melanie Wood kepada TechCrunch, ketika model diminta menyelesaikan persoalan sulit, “there is not human understanding of them at the point of release, and now the work begins.”