Story
OpenAI 发布 GPT-6.1 Sol,以更低的成本提供接近旗舰级的 AI 性能。

Summary
OpenAI 发布了其新的 GPT-6.1 Sol 模型,该公司表示,该模型的性能几乎与其顶级 GPT-6 Astra 相当,但成本却只有后者的五分之一,这加剧了企业 AI 市场的竞争。
OpenAI 周二宣布推出 GPT-6.1 Sol,这是一款全新的人工智能模型,旨在以显著降低的价格提供与旗舰产品 GPT-6 Astra 相媲美的性能。此次发布旨在让开发者和企业用户更容易获得高端人工智能功能,并有望改变人工智能服务的竞争格局。
全新的性价比标杆
据 OpenAI 称,GPT-6.1 Sol 的主要优势在于其成本效益。该模型的定价仅为功能更强大的 GPT-6 Astra 的五分之一,为那些需要在性能和预算之间取得平衡的客户提供了一个全新的中端选择。
该公司详细介绍了新的定价结构:
- 输入令牌: 每百万个令牌 2 美元
- 输出令牌: 每百万个令牌 10 美元
- 缓存输入令牌: 每百万个令牌 0.10 美元
相比之下,Astra 的输入令牌和输出令牌价格分别为 10 美元和 50 美元。GPT-6.1 Sol 的缓存输入令牌价格也比原始 GPT-6 Sol 模型降低了 50%,进一步降低了频繁重复性任务的运行成本。
关键评估的性能
AdOpenAI 发布了多项基准测试结果,以展示新模型的性能。据报道,在 DeepSWE v1.1 软件工程基准测试中,GPT-6.1 Sol 的性能与 GPT-6 Astra 相当,同时保持了更低的成本结构。在同一评估中,它的得分也比其前代产品 GPT-6 Sol 高出 6.4 个百分点。
在涉及复杂文档分析(GDP.pdf)的测试中,GPT-6.1 Sol 的性能优于竞争对手 Opus 5.5 模型,且单项任务成本不到后者的一半。在 OSWorld 2.0 评估的计算机使用任务中,新模型的得分与 Astra 的得分仅相差 2.1 个百分点,而成本仅为后者的七分之一。OpenAI 还指出,与 GPT-6 Sol 相比,GPT-6.1 Sol 在故意设置难题的提示中,事实错误率降低了 32%,从 11.4% 降至 7.7%。
可用性和市场影响
新模型现已通过 ChatGPT Work 和 Codex 面向 Plus、Pro、Business、Enterprise 和 Edu 用户开放。开发者可以通过 OpenAI API 访问该模型,其名称为 `gpt-6.1-sol`。凭借接近顶级水平的性能和更低的价格,OpenAI 致力于让 GPT-6.1 Sol 占据更广泛的市场份额,并在性能和价格方面挑战竞争对手。
展望未来,OpenAI 表示将在未来几天发布 GPT-6.1 Sol Ultrafast,该版本承诺代币生成速度提升高达八倍。此举表明 OpenAI 正在采取细分产品策略,以满足不同用户的需求,从高精度分析到高速实时应用。