Story
GoogleがGemini 4 Argon AIモデルを発表、時間外取引で株価上昇

Summary
Googleは次世代の主力AIモデル「Gemini 4 Argon」を発表し、複数の分野で主要な競合他社を凌駕する性能を示すベンチマークデータを公開した。このニュースを受けて、同社の株価は時間外取引で約2%上昇した。
Googleは水曜日、次世代フラッグシップAIモデル「Gemini 4 Argon」を発表した。この発表を受け、親会社Alphabet(GOOGL)の株価は時間外取引で約2%上昇した。数週間にわたる期待を経ての発表となるこの新モデルは、OpenAIやAnthropicといった主要システムの直接的な競合となる。
新機能のプレビュー
GoogleのCEO、サンダー・ピチャイ氏は、ソーシャルメディアプラットフォームXへの投稿で、Argonをソフトウェアエンジニアリング、サイバー防御、その他の高度なワークフローに関連する複雑なタスクにおいて「最先端のパフォーマンス」を発揮するモデルとして紹介した。現在、リリースは限定的で、ロイター通信によると、Argonはまず一部のサイバーセキュリティパートナーに提供される予定だ。
Googleは、このモデルの一般公開時期についてはまだ発表していない。今回の発表は、先週、同社幹部が「できるだけ早く」リリースすると述べていたことを受け、システムの機能をいち早く垣間見せるものとなった。
競合ベンチマーク結果
Googleは、Argonが主要な競合製品であるOpenAIのGPT-6 AstraとAnthropicのClaude Opus 5.5を、ほとんどのテストで上回る結果となった一連のベンチマークを公開しました。結果は完全な勝利とは言えませんが、Argonは顕著な強みを示しました。
Googleが公開した主なパフォーマンス指標は以下のとおりです。
Ad- Vals Index: Argonは68.9%を獲得し、Claude Opus 5.5の67.0%、GPT-6 Astraの63.1%を上回りました。
- コーディング: DeepSWE v1.1とVibe Code Benchのテストで、それぞれ77.9%と91.9%のスコアを獲得し、Argonがトップとなりました。
- 長文コンテキスト: Argonは、GraphWalksテストにおいて最大128,000トークンで99.7%、最大100万トークンで84.2%の精度を達成し、顕著な優位性を示しました。
- 複雑推論: Agent’s Last Examベンチマークにおいて39.5%のスコアを記録し、GPT-6 Astraの34.2%を上回りました。
競合他社はいくつかの個別テストでArgonを上回る結果を残しており、GPT-6 AstraはFrontierSWE v2で、Claude Opus 5.5はTerminal-bench 4.0でそれぞれトップスコアを記録しました。
市場環境と展望
Argonの発表は、製品開発の遅延を経て、急速に発展するAI分野で競争優位性を維持しようとするGoogleにとって重要な一歩です。ベンチマークにおける高いパフォーマンスは、Googleが最高レベルで競争できる能力を持っていることを示すものです。
しかし、今回発表されたベンチマークは、このモデルの実際の性能に関する疑問が残る中で発表された。ブルームバーグの最近の報道では、直接情報にアクセスできる関係者の話として、Gemini 4は業界ベンチマークでは優れた性能を発揮したものの、社内の実際のアプリケーションではそれほど印象的ではなかったと指摘されている。Googleはこの見解に反論し、コーディングやデータセンターの最適化といった複雑なタスクにArgonを社内で活用していることを強調している。