Story
OpenAI, 플래그십 'Sol' 포함한 GPT-5.6 모델 제품군 정식 출시

Summary
OpenAI가 플래그십 모델 'Sol'을 필두로 한 GPT-5.6 모델 제품군을 정식 출시했습니다. 이번 신규 모델은 주요 벤치마크에서 경쟁사를 압도하는 성능과 비용 효율성을 입증하며 AI 시장 경쟁 구도에 영향을 미칠 전망입니다.
OpenAI가 제한된 사전 공개 기간을 거쳐 목요일(현지시간) GPT-5.6 모델 제품군을 정식 출시했습니다. 이번에 공개된 모델은 새로운 플래그십 모델인 'Sol'과 일상 업무에 최적화된 균형 모델 'Terra', 그리고 가장 비용 효율적인 옵션인 'Luna'로 구성됩니다.
경쟁사 압도하는 성능 및 비용 효율성
OpenAI에 따르면, 플래그십 모델인 GPT-5.6 Sol은 여러 핵심 성능 평가(벤치마크)에서 경쟁 모델을 크게 앞섰습니다. 특히 비용 효율성 측면에서 주목할 만한 성과를 보였습니다.
- 전문 워크플로우 평가: 'Agents’ Last Exam' 평가에서 Sol은 53.6점을 기록해 경쟁 모델인 'Claude Fable 5'를 13.1점 차이로 앞섰습니다. 중간 수준의 추론 능력 테스트에서는 약 4분의 1 비용으로 Fable 5보다 11.4점 높은 점수를 기록했습니다.
- 코딩 작업 평가: 'Artificial Analysis Coding Agent Index'에서 Sol은 Fable 5보다 2.8점 높은 80점을 획득했으며, 이때 소요된 출력 토큰과 시간은 절반 미만, 비용은 약 3분의 1 수준이었습니다.
- 종합 지능 평가: 'Artificial Analysis Intelligence Index'에서는 Fable 5와 거의 동등한 점수를 기록하면서도, 작업 완료 시간은 61% 단축하고 비용은 절반 수준으로 절감했습니다.
코도(Qodo)의 공동 창업자 겸 CEO인 이타마르 프리드먼은 GPT-5.6이 자사의 에이전트 코드 리뷰 테스트에서 평가한 모델 중 가장 강력했다고 밝혔습니다. 그는 GPT-5.5 대비 토큰 사용량은 약 3분의 1로 줄이면서도 지연 시간은 절반으로 단축했다고 평가했습니다.
새로운 기능 및 안전 조치 강화
OpenAI는 이번 출시와 함께 '울트라(ultra)'라는 새로운 기능 설정을 도입했습니다. 이 설정은 기본적으로 4개의 에이전트를 병렬로 조정하여, 더 많은 토큰을 사용하는 대신 까다로운 작업에서 더 나은 결과와 빠른 완료 시간을 제공합니다.
Ad또한, GPT-5.6은 사이버 보안 및 생물학 분야에서 이전 모델보다 향상된 성능을 보이지만, OpenAI가 설정한 '치명적(Critical)' 위험 임계값은 넘지 않는다고 밝혔습니다. 회사는 모델에 내장된 보호 장치, 실시간 검사, 지속적인 모니터링 등 다층적인 안전 장치를 배포했으며, 출시 전 약 70만 A100e GPU 시간에 달하는 자동화된 레드팀 테스트를 거쳤다고 강조했습니다.
API 가격 및 이용 안내
GPT-5.6 모델은 ChatGPT, Codex 및 OpenAI API를 통해 목요일부터 전 세계에 순차적으로 배포됩니다. API 가격은 100만 토큰당 다음과 같이 책정되었습니다.
- Sol: 입력 $5, 출력 $30
- Terra: 입력 $2.50, 출력 $15
- Luna: 입력 $1, 출력 $6
캐시(Cache) 쓰기는 모델의 캐시되지 않은 입력 요율의 1.25배로 청구되며, 캐시 읽기는 90%의 캐시된 입력 할인을 받게 됩니다. 이번 가격 정책은 개발자와 기업 고객의 모델 선택 및 운영 비용에 직접적인 영향을 미칠 것으로 보입니다.