Story
Google Meluncurkan Model AI Gemini 4 Argon, Saham Naik dalam Perdagangan Setelah Jam Tutup Bursa

Summary
Google mengumumkan model AI unggulan generasi berikutnya, Gemini 4 Argon, dengan menerbitkan data benchmark yang menunjukkan bahwa model ini mengungguli para pesaing utamanya di beberapa bidang. Saham perusahaan naik sekitar 2% dalam perdagangan setelah jam kerja menyusul berita tersebut.
Pada hari Rabu, Google meluncurkan Gemini 4 Argon, model kecerdasan buatan unggulan generasi berikutnya, yang mendorong kenaikan saham perusahaan induk Alphabet (GOOGL) sekitar 2% dalam perdagangan setelah jam kerja. Pengumuman ini, yang menyusul antisipasi selama beberapa minggu, memposisikan model baru ini sebagai pesaing langsung sistem terkemuka dari OpenAI dan Anthropic.
Pratinjau Kemampuan Baru
Dalam sebuah unggahan di platform media sosial X, CEO Google Sundar Pichai memperkenalkan Argon sebagai model yang menunjukkan "kinerja terdepan" dalam tugas-tugas kompleks yang terkait dengan rekayasa perangkat lunak, pertahanan siber, dan alur kerja canggih lainnya. Rilis saat ini terbatas, dengan Reuters melaporkan bahwa Argon awalnya diberikan kepada kelompok mitra keamanan siber terpilih.
Google belum memberikan jadwal ketersediaan umum model ini. Pengumuman ini berfungsi sebagai gambaran awal kemampuan sistem, menyusul komentar pekan lalu dari seorang eksekutif perusahaan yang mengindikasikan bahwa versi tersebut akan dirilis "sesegera mungkin."
Hasil Benchmark Kompetitif
Google merilis serangkaian benchmark yang menempatkan Argon di depan para pesaing utamanya, GPT-6 Astra dari OpenAI dan Claude Opus 5.5 dari Anthropic, pada sebagian besar tes yang ditampilkan. Meskipun hasilnya tidak mewakili kemenangan telak, Argon menunjukkan kekuatan yang patut diperhatikan.
Metrik kinerja utama yang dipublikasikan oleh Google meliputi:
Ad- Indeks Nilai: Argon mencetak 68,9%, dibandingkan dengan 67,0% untuk Claude Opus 5.5 dan 63,1% untuk GPT-6 Astra.
- Pengkodean: Model ini unggul pada tes DeepSWE v1.1 dan Vibe Code Bench, dengan skor masing-masing 77,9% dan 91,9%.
- Konteks Panjang: Argon menunjukkan keunggulan yang signifikan, mencapai akurasi 99,7% pada tes GraphWalks dengan hingga 128.000 token dan 84,2% pada tes dengan hingga 1 juta token. - Penalaran Kompleks: Ia mencetak 39,5% pada benchmark Agent’s Last Exam, mengungguli GPT-6 Astra yang mencetak 34,2%.
Para pesaing memang mengungguli Argon pada beberapa tes individual, dengan GPT-6 Astra memimpin pada FrontierSWE v2 dan Claude Opus 5.5 mencetak skor tertinggi pada Terminal-bench 4.0.
Konteks dan Prospek Pasar
Peluncuran Argon merupakan langkah penting bagi Google dalam upaya mempertahankan keunggulan kompetitifnya di sektor AI yang berkembang pesat setelah mengalami penundaan produk. Kinerja benchmark yang kuat dimaksudkan untuk menandakan kemampuan Google untuk bersaing di level tertinggi.
Namun, benchmark yang diberikan muncul di tengah pertanyaan tentang kinerja model di dunia nyata. Sebuah laporan Bloomberg baru-baru ini, yang mengutip orang-orang dengan akses langsung, menunjukkan bahwa meskipun Gemini 4 berkinerja baik pada benchmark industri, ia kurang mengesankan dalam aplikasi internal di dunia nyata. Google membantah karakterisasi ini, dengan menyoroti penggunaan internal Argon untuk tugas-tugas kompleks seperti pengkodean dan optimasi pusat data.