Story

구글, 제미니 4호 아르곤 AI 모델 공개…시간외거래에서 주가 상승

ENTHMSVIIDZHZH-TWJAKOHI
Sep 30, 20262 min read
구글, 제미니 4호 아르곤 AI 모델 공개…시간외거래에서 주가 상승

Summary

구글은 차세대 플래그십 AI 모델인 제미니 4 아르곤(Gemini 4 Argon)을 발표하고, 여러 분야에서 주요 경쟁사들을 능가하는 성능을 보여주는 벤치마크 데이터를 공개했습니다. 이 소식에 힘입어 구글의 주가는 시간외 거래에서 약 2% 상승했습니다.

Text size
Background

수요일, 구글은 차세대 플래그십 인공지능 모델인 제미니 4 아르곤(Gemini 4 Argon)을 공개했습니다. 이 소식에 모회사인 알파벳(GOOGL)의 주가는 시간외 거래에서 약 2% 상승했습니다. 몇 주간의 기대 속에 발표된 이번 소식은 새로운 모델이 오픈AI와 앤스로픽의 선도적인 시스템과 직접 경쟁할 수 있음을 보여줍니다.

새로운 기능 미리보기

구글 CEO 순다르 피차이는 소셜 미디어 플랫폼 X에 올린 글에서 아르곤을 소프트웨어 엔지니어링, 사이버 방어 및 기타 고급 워크플로와 관련된 복잡한 작업에서 "최첨단 성능"을 보여주는 모델이라고 소개했습니다. 현재 아르곤은 제한적으로 제공되고 있으며, 로이터 통신에 따르면 초기에는 일부 사이버 보안 파트너에게만 제공되고 있습니다.

구글은 아직 모델의 일반 공개 시점에 대한 구체적인 일정을 발표하지 않았습니다. 이번 발표는 지난주 회사 임원이 "가능한 한 빨리" 버전을 출시할 것이라고 언급한 데 이어 시스템의 기능을 미리 보여주는 자리였습니다.

경쟁 벤치마크 결과

구글은 Argon이 주요 경쟁 모델인 OpenAI의 GPT-6 Astra와 Anthropic의 Claude Opus 5.5보다 대부분의 테스트에서 우위를 점하고 있음을 보여주는 일련의 벤치마크 결과를 발표했습니다. 모든 테스트에서 완벽한 결과를 얻은 것은 아니지만, Argon은 주목할 만한 강점을 보여주었습니다.

구글이 공개한 주요 성능 지표는 다음과 같습니다.

Sample IUX Markets – In-articleAd
  • 검증 지수(Vals Index): Argon은 68.9%를 기록하여 Claude Opus 5.5의 67.0%와 GPT-6 Astra의 63.1%를 앞섰습니다.
  • 코딩: Argon은 DeepSWE v1.1 및 Vibe Code Bench 테스트에서 각각 77.9%와 91.9%의 점수를 기록하며 선두를 차지했습니다.
  • 장문 컨텍스트 테스트: Argon은 GraphWalks 테스트에서 최대 128,000개의 토큰을 사용하여 99.7%의 정확도를, 최대 100만 개의 토큰을 사용한 테스트에서는 84.2%의 정확도를 달성하며 상당한 우위를 보였습니다.
  • 복합 추론: Agent’s Last Exam 벤치마크에서 39.5%의 점수를 기록하며 GPT-6 Astra의 34.2%를 앞섰습니다.

하지만 경쟁 제품들은 몇몇 개별 테스트에서 Argon보다 우수한 성능을 보였습니다. GPT-6 Astra는 FrontierSWE v2에서, Claude Opus 5.5는 Terminal-bench 4.0에서 최고 점수를 기록했습니다.

시장 상황 및 전망

Argon의 공개는 제품 출시 지연을 겪은 후 빠르게 발전하는 AI 분야에서 경쟁력을 유지하려는 Google에게 중요한 발걸음입니다. 강력한 벤치마크 성능은 Google이 최고 수준에서 경쟁할 수 있는 능력을 갖추고 있음을 보여주는 신호입니다.

하지만 제공된 벤치마크 결과는 모델의 실제 성능에 대한 의문이 제기되는 가운데 나온 것입니다. 최근 블룸버그는 내부 관계자를 인용하여 제미니 4가 업계 벤치마크에서는 우수한 성능을 보였지만, 내부 실제 적용 사례에서는 기대에 미치지 못했다고 보도했습니다. 구글은 이러한 분석에 반박하며 코딩 및 데이터 센터 최적화와 같은 복잡한 작업에 아르곤을 내부적으로 활용하고 있다고 강조했습니다.

Back to latest news

LATEST