Story

Google發布Gemini 4 Argon人工智慧模型,盤後股價上漲

ENTHMSVIIDZHZH-TWJAKOHI
Sep 30, 20261 min read
Google發布Gemini 4 Argon人工智慧模型,盤後股價上漲

Summary

谷歌發布了其下一代旗艦人工智慧模型 Gemini 4 Argon,並公佈了基準測試數據,顯示其在多個領域超越了主要競爭對手。消息公佈後,Google股價在盤後交易中上漲了約 2%。

Text size
Background

谷歌週三發布了其下一代旗艦人工智慧模型 Gemini 4 Argon,此舉推動其母公司 Alphabet (GOOGL) 的股價在盤後交易中上漲約 2%。在此之前數週,市場對 Argon 的期望已久,此次發布標誌著這款新模型將直接與 OpenAI 和 Anthropic 等領先系統競爭。

新功能預覽

Google執行長 Sundar Pichai 在社群媒體平台 X 上發文,介紹 Argon 模型,稱其在軟體工程、網路防禦和其他高級工作流程等複雜任務中展現了「前沿性能」。目前,Argon 的發布範圍有限,路透社報導,Argon 最初僅提供給部分網路安全合作夥伴。

谷歌尚未公佈該模型面向公眾的發佈時間表。先前,一位公司高層曾表示,Argon 的某個版本將「盡快」發布,這次發布也算是提前展示了該系統的部分功能。

競爭基準測試結果

谷歌發布了一系列基準測試結果,顯示 Argon 在大多數測試中都領先於其主要競爭對手,包括 OpenAI 的 GPT-6 Astra 和 Anthropic 的 Claude Opus 5.5。雖然結果並非完全碾壓,但 Argon 展現出了顯著的優勢。

谷歌發布的關鍵效能指標包括:

Sample IUX Markets – In-articleAd
  • Vals Index: Argon 得分 68.9%,而 Claude Opus 5.5 和 GPT-6 Astra 的得分分別為 67.0% 和 63.1%。
  • Coding: 此模型在 DeepSWE v1.1 和 Vibe Code Bench 測驗中均名列前茅,得分分別為 77.9% 和 91.9%。
  • 長上下文: Argon 展現出顯著優勢,在 GraphWalks 測試中,使用多達 128,000 個 token 時準確率高達 99.7%,在多達 100 萬個 token 的測試中準確率也達到了 84.2%。
  • 複雜推理: Argon 在 Agent’s Last Exam 基準測試中得分 39.5%,高於 GPT-6 Astra 的 34.2%。

在一些單獨的測試中,競爭對手的表現優於 Argon,其中 GPT-6 Astra 在 FrontierSWE v2 測試中領先,而 Claude Opus 5.5 在 Terminal-bench 4.0 測試中取得了最高分。

市場背景與展望

在經歷了產品延期之後,Google推出 Argon 是其在快速發展的 AI 領域保持競爭優勢的關鍵一步。 Argon 的出色基準測試表現旨在表明谷歌有能力在最高水平的競爭中脫穎而出。

然而,這些基準測試結果出爐之際,人們對該模型在實際應用中的表現仍有疑問。彭博社近期引述知情人士的消息報道稱,儘管 Gemini 4 在行業基準測試中表現出色,但在內部實際應用中卻不盡如人意。谷歌對此予以反駁,並強調其內部使用 Argon 模型處理編碼和資料中心最佳化等複雜任務。

Back to latest news

LATEST