Kenapa Gemini 4 Argon Rilis Tapi Belum Bisa Dipakai?
Gemini 4 Argon rilis 30 September 2026 dengan output 1 juta token dan skor DeepSWE 77,9 persen. Tapi kenapa Google cuma buka akses buat cyber defender dulu?
Google resmi mengumumkan Gemini 4 Argon pada 30 September 2026. Model ini disebut sebagai era baru frontier intelligence, dengan fokus ke software engineering, kerja enterprise, dan pertahanan siber. Tapi ada satu hal yang bikin pengumuman ini beda dari rilis model lain tahun ini.
Kamu belum bisa memakainya. Akses pertama cuma dibuka untuk cyber defender terpilih lewat program Fairwind milik Google. Versi yang mereka dapat bahkan dilepas tanpa cyber guardrails, sesuatu yang belum pernah dilakukan Google untuk model frontier sebelumnya.

Jadi pertanyaannya bukan sekadar seberapa pintar model ini. Pertanyaannya, kenapa Google berani merilis model paling mumpuni mereka dengan cara seperti ini, dan apa artinya buat kamu yang masih nunggu di antrean. Gua sudah baca post pengumumannya dan analisis komunitasnya, dan ada beberapa angka yang layak kamu catat. Kalau kamu penasaran eksperimen agent seperti apa yang gua jalanin sendiri, cek /projects.
Gemini 4 Argon Itu Apa dan Kenapa Rilisnya Beda
Gemini 4 Argon adalah model frontier terbaru Google DeepMind, diumumkan oleh Koray Kavukcuoglu yang sekarang menjabat SVP Google DeepMind sekaligus Chief AI Architect Google. Model ini dirancang untuk long-horizon workflow, yaitu pekerjaan yang butuh penalaran panjang dan banyak langkah: software engineering dunia nyata, kerja enterprise seperti legal dan finance, serta cybersecurity defense.
Satu perubahan teknis paling jelas ada di output limit. Google menaikkan batas output dari 64 ribu token menjadi 1 juta token, angka yang mereka sebut industry-leading. Praktisnya, migrasi satu modul besar atau analisis ribuan baris log bisa jalan dalam satu panggilan tanpa harus menyambung potongan hasil.
Harga perkenalannya 2 dolar per juta input token dan 10 dolar per juta output token, dengan cached input didiskon 95 persen. Angka ini sama persis dengan harga GPT-6.1 Sol yang rilis sehari sebelumnya. Setelah masa perkenalan selesai, harganya naik ke 4 dolar dan 20 dolar.
Angka Benchmark: Menang di Banyak Baris, Kalah di Dua yang Penting
Di DeepSWE v1.1, benchmark software engineering jangka panjang, Argon mencetak 77,9 persen dan jadi state of the art. Di AutomationBench milik Zapier yang mengukur eksekusi workflow bisnis end-to-end, Argon ranking satu dengan 51,3 persen. Di LVBench untuk pemahaman video panjang, skornya 91,7 persen, juga state of the art.
Di sisi keamanan, Argon seri di posisi pertama CWE-bench v1 dengan 68 persen untuk kemampuan menambal celah keamanan. Google juga menempatkannya terdepan di Vals Index yang mengukur dampak ekonomi di sektor finance, coding, legal, dan tax. Dari 19 baris tabel benchmark Google, Argon terbaik di 13 baris, seri 1 baris, dan kalah di 5 baris.
Tapi dua baris yang kalah itu justru yang paling relevan buat developer. Di FrontierSWE v2, Argon cuma 55,0 persen dan jadi yang terakhir dari empat model, di bawah GPT-6 Astra yang 65,5 persen. Di Terminal-bench 4.0 yang menaruh agent di shell beneran, Argon 57,4 persen, juga terakhir, tertinggal sembilan poin dari Claude Opus 5.5.
Kata Pihak Ketiga: Skor Independen dan Reaksi Komunitas
Satu-satunya leaderboard independen yang sudah menguji Argon adalah Artificial Analysis. Di sana Argon (high) skor 53 di Intelligence Index, seri di posisi kedua dengan GPT-6 Astra dan Claude Fable 5.1. Claude Opus 5.5 masih memimpin di 58.
Yang menarik justru tagihannya. Satu run indeks butuh biaya 1,99 dolar per task dengan Argon, lawan 5,98 dolar dengan Opus 5.5, alias sekitar sepertiga. Tapi Argon juga cerewet: dia memakai sekitar 110 juta output token untuk menjalankan indeks, di atas median 82 juta. Di harga 10 dolar per juta output token, verbosity itu ikut masuk ke tagihan kamu.
Di Hacker News, thread pengumumannya tembus 1.400 points. Komentar yang paling ramai justru soal migrasi Rust, bukan benchmark. Ada juga nada skeptis: Bloomberg melaporkan beberapa karyawan Google sendiri bilang performa kerja nyata Argon tidak secerah skor benchmarknya, dan dua orang menyebutnya kena benchmaxxing. Google membantah laporan itu.
Bukti Internal: 800 Ribu Baris Kode Dimigrasi Agent
Google bilang ribuan karyawannya sudah memakai Argon, dan contoh paling konkret adalah migrasi codebase. Agent Argon mengerjakan migrasi kode C dan C++ ke Rust di internal Google, dari puluhan ribu baris di library inti seperti re2 dan libgav1 sampai 800 ribu lebih baris untuk kernel Zircon di Fuchsia OS.
Kasus libgav1 layak dicatat. Argon mengambil port Rust yang sudah ada, mengganti 32 ribu baris kode SIMD lewat eksperimen berulang yang dipandu profiling, lalu menghasilkan decoder video yang memory-safe dan 2,7 kali lebih cepat dari port Rust sebelumnya dengan output video yang identik.
Contoh lain: optimasi algoritma kuantum 40 persen lebih baik dari baseline publik dalam hitungan menit, dan penghematan memori lebih dari 300 TiB di data center Google. Di sisi keamanan, Wiz melaporkan Argon menemukan celah kritis di software rumah sakit yang dipakai rumah sakit di seluruh dunia, celah yang model frontier sebelumnya lewatkan. Satu catatan jujur: Wiz adalah anak perusahaan Google yang diakuisisi 32 miliar dolar, jadi angka ini datang dari dalam rumah sendiri.
Kapan Kamu Bisa Pakai dan Apa yang Harus Dilakukan Sekarang
Jawaban singkatnya: belum ada tanggal. Urutan rilisnya dimulai dari cyber defender di program Fairwind, lalu paid API customers dan pelanggan Google AI Ultra. Developer, enterprise, dan konsumen umum menyusul setelah itu. Program Fairwind sendiri sudah punya lebih dari 650 partner global, dan aturannya ketat: akses Argon cuma boleh diberikan ke tim cybersecurity, incident response, atau penetration testing internal.
Sebelum rilis luas, Google menyiapkan empat lapis safeguard: refusal untuk penyalahgunaan cyber dan CBRN, pertahanan prompt injection, monitoring misalignment yang bisa menghentikan task di tengah jalan, dan hardening sandbox. Mereka juga ikut proses voluntary pre-release access pemerintah AS.
Buat kamu, tidak ada yang perlu diubah minggu ini. Harga Argon sama dengan GPT-6.1 Sol yang sudah bisa dibeli hari ini, dan Opus 5.5 masih memimpin skor independen. Kalau use case kamu adalah agent yang kerja di repo, pelajaran dari tabel benchmark jelas: uji sendiri di shell beneran pada hari pertama kamu dapat akses, jangan cuma percaya angka brosur.
Kesimpulan
Gemini 4 Argon menarik karena satu alasan teknis yang konkret: output 1 juta token membuka kelas workflow yang sebelumnya mustahil dalam satu panggilan. Ditambah harga perkenalan yang agresif dan bukti migrasi 800 ribu baris kode di internal Google.
Tapi dua catatan jangan dilupakan. Pertama, di benchmark agentic yang paling mirip kerja nyata, Argon justru kalah di tabel Google sendiri. Kedua, kamu belum bisa menyentuhnya, dan tidak ada tanggal kapan bisa. Pantau terus, siapkan benchmark repo kamu sendiri, dan nilai lagi saat aksesnya dibuka.

Dimas Febriyanto
Fullstack & Mobile Developer specializing in Golang & Flutter. Aktif sebagai Junior Mobile Developer di Sagara Technology & asisten lab di Universitas Gunadarma. Passionate about building scalable algorithms & high-impact applications.
Lihat Portofolio