October 8, 2026
Updated:
8 min read

Kenapa OpenAI Klaim AI-nya Pecahkan 722 Masalah Matematika?

OpenAI membuka repo openai/math: 722 naskah matematika buatan AI internal, lengkap formalisasi Lean. Ini bedah lengkapnya, termasuk sisi yang tidak diceritakan.

Model bahasa yang kamu pakai sehari-hari ternyata sedang belajar menjadi matematikawan. Bukan sekadar mengerjakan soal latihan, tapi menghasilkan makalah riset yang belum pernah ada sebelumnya.

Minggu ini, OpenAI membuka repo publik bernama openai/math. Isinya 722 naskah matematika yang dihasilkan model AI internal mereka, lengkap dengan formalisasi bukti di Lean dan ringkasan penalaran. Repo yang dibuat 6 Oktober 2026 itu sudah mengumpulkan lebih dari 9.000 star dalam dua hari, dan menjadi diskusi terpanas di Hacker News dengan 1.219 poin dan hampir 1.400 komentar.

Kenapa OpenAI Klaim AI-nya Pecahkan 722 Masalah Matematika?

Kedengarannya seperti lompatan besar dari AI yang biasanya hanya menjawab chat. Mari kita bedah satu per satu: apa yang sebenarnya dirilis, bagaimana cara kerjanya, dan di mana batas klaimnya.

Apa Sebenarnya yang Dirilis OpenAI

Repo openai/math berisi katalog 722 naskah yang dikelompokkan ke dalam 372 keluarga. Satu keluarga bisa berisi hasil utama, argumen pendamping, konsekuensi, atau bukti alternatif, semuanya diklasifikasikan per cabang matematika. Berkasnya berlisensi Apache 2.0 dan menyertakan berkas overview yang merangkum semua keluarga.

Yang membedakan rilis ini dari sekadar tumpukan makalah adalah protokolnya. Setiap naskah punya instruksi sitasi dan build sendiri, riwayat revisinya diawetkan sebagai versi baru, dan versi lama tetap bisa diakses. OpenAI juga berkonsultasi dengan Advisory Group on Mathematics and Artificial Intelligence di Institute for Advanced Study untuk menyusun standar rilis yang baik.

Bagaimana Modelnya Menghasilkan Semua Ini

Menurut README repo, hampir semua hasil diperoleh dengan prosedur yang sama memakai satu model internal OpenAI yang belum dirilis. Model itu diuji pada sekitar 4.000 masalah riset terbuka, setelah performa mereka pada evaluasi matematika yang sudah ada mengalami saturasi.

Rata-rata satu hasil menelan komputasi setara tiga jam berpikir model ChatGPT Pro. Dari ribuan keluaran itu, yang lolos seleksi signifikansi dikumpulkan menjadi katalog 722 naskah. Demi transparansi, OpenAI merilis 10 ringkasan penalaran model, estimasi komputasi per hasil, dan statistik jumlah percobaan masalah.

Hasil-Hasil Terberatnya

Daftar masalahnya bukan main-main. Ada zero-free region untuk fungsi zeta Riemann pada Re(s) lebih besar dari 11/12, bukti Hodge Conjecture untuk varietas abelian CM, eksponen irasionalitas bilangan pi, konjektur Mahler, sampai isomorfisme faktor grup bebas. Khusus tulisan tentang zero-free region zeta Riemann disunting manusia agar mudah dibaca.

Ringkasan penalarannya mencakup 10 keluarga, mulai dari korelasi fungsi multiplikatif sampai sistem Vlasov-Maxwell relativistik tiga dimensi. Semua ini adalah topik riset aktif yang biasanya membutuhkan kerja bertahun-tahun dari ahli manusia.

Standar Baru yang Mereka Usulkan

OpenAI tidak hanya merilis hasil, tapi mengusulkan cara baru berbagi hasil AI dengan komunitas matematika. Formalisasi di Lean memungkinkan bukti dicek komputer, protokol revisi menjaga integritas sitasi, dan data transparansi menunjukkan biaya serta tingkat keberhasilan model.

Mereka juga berencana mendanai workshop, konferensi, dan program khusus untuk memahami hasil besar yang dihasilkan AI. Tujuannya dinyatakan jelas: mendorong batas pengetahuan manusia, bukan sekadar pamer angka benchmark. Model yang menghasilkan semua ini rencananya akan dirilis secara bertanggung jawab.

Transparansi semacam ini jarang terjadi. Biasanya lab AI hanya merilis angka benchmark, tanpa mengungkap berapa percobaan yang gagal atau berapa biaya komputasi yang dibakar. Di sini, OpenAI justru memamerkan dapurnya: statistik jumlah masalah yang dicoba, estimasi komputasi per hasil, dan pengakuan terbuka bahwa sebagian naskah belum diformalisasi. Itu standar keterbukaan yang patut ditiru, sekaligus pengingat bahwa angka besar seperti 722 tetap perlu dibaca kritis oleh siapa pun, termasuk komunitas matematika yang selama ini skeptis terhadap klaim AI.

Bagian yang Tidak Diceritakan

Di sinilah kita perlu bersikap jujur. README repo ini sendiri mengakui tidak semua naskah punya formalisasi Lean, dan beberapa hasil yang belum diformalisasi bisa bermasalah. Verifikasi penuh oleh komunitas matematika akan memakan waktu lama.

Kenapa OpenAI Klaim AI-nya Pecahkan 722 Masalah Matematika?

Selain itu, semua angka dan klaim signifikansi datang dari OpenAI sendiri. Modelnya belum dirilis, jadi belum ada pihak independen yang bisa mereplikasi prosedurnya. Klaim 722 naskah terdengar besar, tapi kita belum tahu berapa yang akan bertahan setelah ditelaah pakar manusia.

Ini bukan berarti rilisnya tidak berharga. Justru transparansi soal biaya komputasi dan tingkat kegagalannya membuat rilis ini lebih kredibel dari sekadar siaran pers. Tapi bedakan: ini langkah maju dalam kemampuan AI mengerjakan matematika, bukan bukti AI sudah menggantikan matematikawan.

Kenapa Ini Penting Buat Kamu

Bagi developer, rilis ini membuka pola baru: AI sebagai mesin penjelajah masalah terbuka, dengan manusia sebagai kurator dan verifikator. Formalisasi Lean menunjukkan bagaimana bukti bisa dicek mesin, sesuatu yang bisa menginspirasi workflow verifikasi di software juga.

Bagi kamu yang suka matematika, repo ini adalah tambang belajar gratis. Kamu bisa membaca makalah asli, ringkasan penalaran model, sampai bukti formalnya tanpa membayar apapun. Kalau kamu suka proyek eksperimen semacam ini, daftar proyek saya ada di /projects.

Dimas Febriyanto - Fullstack Developer

Dimas Febriyanto

Fullstack & Mobile Developer specializing in Golang & Flutter. Aktif sebagai Junior Mobile Developer di Sagara Technology & asisten lab di Universitas Gunadarma. Passionate about building scalable algorithms & high-impact applications.

Lihat Portofolio

Liked this article?

Feel free to share it with your network or reach out if you have any questions!