Story
OpenAIがGPT-6.1 Solを発表、フラッグシップAIに匹敵する性能を大幅に低コストで提供

Summary
OpenAIは、同社の最上位モデルであるGPT-6 Astraとほぼ同等の性能を5分の1のコストで実現したという、新しいGPT-6.1 Solモデルを発表した。これにより、企業向けAI市場における競争が激化するとみられる。
OpenAIは火曜日、フラッグシップモデルであるGPT-6 Astraと同等の性能を、大幅に低価格で提供する新しい人工知能モデル「GPT-6.1 Sol」のリリースを発表しました。このリリースは、ハイエンドAI機能を開発者や企業ユーザーにとってより身近なものにし、AIサービスにおける競争環境を大きく変える可能性を秘めています。
新たなコストパフォーマンスのベンチマーク
OpenAIによると、GPT-6.1 Solの最大のメリットはコスト効率の高さです。このモデルは、より高性能なGPT-6 Astraの5分の1の価格で提供され、性能と予算の制約のバランスを取りたい顧客にとって、新たなミドルレンジの選択肢となります。
同社は新しい料金体系を以下のように発表しました。
- 入力トークン: 100万トークンあたり2ドル
- 出力トークン: 100万トークンあたり10ドル
- キャッシュ済み入力トークン: 100万トークンあたり0.10ドル
これは、Astraの入力トークンが10ドル、出力トークンが50ドルだったのと比較すると大幅な値下げとなります。GPT-6.1 Solのキャッシュ済み入力トークンの料金は、従来のGPT-6 Solモデルと比較して50%削減されており、頻繁に繰り返されるタスクの運用コストをさらに低減します。
主要評価におけるパフォーマンス
AdOpenAIは、新モデルの性能を示すために、いくつかのベンチマーク結果を公開しました。DeepSWE v1.1ソフトウェアエンジニアリングベンチマークにおいて、GPT-6.1 Solは低コスト構造を維持しながら、GPT-6 Astraと同等のパフォーマンスを達成したと報告されています。また、同じ評価において、前モデルのGPT-6 Solよりも6.4パーセントポイント高いスコアを記録しました。
複雑な文書分析(GDP.pdf)を含むテストにおいて、GPT-6.1 Solは競合モデルであるOpus 5.5を、タスクあたりのコストを半分以下に抑えながら上回る性能を発揮しました。OSWorld 2.0で測定したコンピュータ利用タスクでは、新モデルはAstraのスコアにわずか2.1パーセントポイント差まで迫り、コストはわずか7分の1でした。OpenAIはまた、意図的に難易度を上げたプロンプトに対する事実誤認率がGPT-6 Solと比較して32%減少し、エラー率が11.4%から7.7%に低下したことも確認しました。
提供状況と市場への影響
新モデルは、ChatGPT WorkおよびCodexを通じて、Plus、Pro、Business、Enterprise、Eduの各プランのユーザーに即時提供されます。開発者は、OpenAI APIを通じて「gpt-6.1-sol」という名称でアクセスできます。OpenAIは、ほぼ最高レベルの性能を大幅に低い価格で提供することで、GPT-6.1 Solがより幅広い市場セグメントを獲得し、性能と価格の両面で競合他社に挑戦できる位置づけを目指しています。
OpenAIは今後について、トークン生成速度が最大8倍向上したとされるGPT-6.1 Sol Ultrafastを近日中にリリースすると発表した。この動きは、高精度分析から高速リアルタイムアプリケーションまで、多様なユーザーニーズに対応するため、製品・サービスを細分化する戦略を示唆している。