OpenAI发布GPT-6.1 Sol模型,性能媲美Astra费用仅1/5
同性能下最高性价比 AI 模型:OpenAI 发布 GPT-6.1 Sol,性能媲美 Astra、费用仅为 1/5
OpenAI新出的GPT-6.1 Sol,性能接近旗舰Astra但只要1/5价格,适合预算有限但需要高性能的开发者。
OpenAI推出GPT-6.1 Sol模型,在智能体编程、电脑操作等专业任务上性能接近旗舰GPT-6 Astra,但标准输入/输出token价格仅为Astra的五分之一。该模型在软件工程基准测试DeepSWE v1.1中表现与Astra相当,在电脑操作OSWorld 2.0测试中得分比GPT-6 Sol高7个百分点。GPT-6.1 Sol每100万Token缓存费用为0.1美元,比GPT-6 Sol定价低50%,事实错误率从11.4%降至7.7%。
同性能下最高性价比 AI 模型:OpenAI 发布 GPT-6.1 Sol,性能媲美 Astra、费用仅为 1/5
IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者活动日中,官方正式宣布推出 GPT-6.1 Sol 模型,在性能接近 Astra 的同时,其费用仅为 Astra 的五分之一, 官方称这是“在目前同等性能下性价比最高的模型”。 GPT‑6 Astra 是 OpenAI 在 2026 年 9 月推出的旗舰级大语言模型,官方定位是“迄今最智能、最对齐(最符合人类意图)”的模型,重点面向长程多步骤任务与专业工作流。 费用方面,根据官网公布的费用细节,IT之家附上相关售价信息如下: gpt-6.1-sol 全模式定价表(短上下文,输入 tokens ≤ 272,000) 模式 输入 (Input) 缓存输入 (Cached input) 缓存写入 (Cache writes) 输出 (Output) Standard(标准) $2.00 $0.10 $2.50 $10.00 Batch(批量) $1.00 $0.05 $1.25 $5.00 Flex(弹性) $1.00 $0.05 $1.25 $5.00 Fast(快速) $4.00 $0.20 $5.00 $20.00 gpt-6.1-sol 全模式定价表(长上下文,输入 tokens > 272,000) 模式 输入 (Input) 缓存输入 (Cached input) 缓存写入 (Cache writes) 输出 (Output) Standard(标准) $4.00 $0.20 $5.00 $15.00 Batch(批量) $2.00 $0.10 $2.50 $7.50 Flex(弹性) $2.00 $0.10 $2.50 $7.50 Fast(快速) $8.00 $0.40 $10.00 $30.00 上述 4 种处理模式区别如下: 模式 处理速度 适用场景 价格特点 Standard(标准) 正常速度 日常开发、一般应用 基准价格 Batch(批量) 较慢(异步批量处理) 非实时、大批量任务(如离线数据处理) 通常与 Standard 价格相同或略低 Flex(弹性) 可变(根据负载动态调整) 需要成本与速度平衡的场景 价格介于 Standard 和 Fast 之间 Fast(快速) 最快(优先处理) 对延迟敏感的应用(如实时对话、低延迟响应) 价格最高,通常为 Standard 的 2 倍左右 性价比方面,官方表示 GPT-6.1 Sol 模型每 100 万 Token 的缓存费用为 0.1 美元 (IT之家注:现汇率约合 0.67 元人民币) ,相比较 GPT-6 Sol 模型定价低 50%。 在性能方面,在智能体编程、电脑操作和专业工作流等任务上,性能接近旗舰 GPT‑6 Astra,但标准输入 / 输出 token 价格只有 Astra 的五分之一。 软件工程(DeepSWE v1.1):在较高推理强度下,GPT‑6.1 Sol 的表现与 GPT‑6 Astra 相当;在较低推理强度 / 成本条件下,其得分比 GPT‑6 Sol 高出 6.4 个百分点。 专业文档与复杂任务( GDP.pdf ):以不到 Opus 5.5 一半的任务成本,取得更好结果。 自动化工作流(AutomationBench,中等推理强度):得分比 Opus 5.5 高 2.2 个百分点,成本约为其三分之一。 电脑操作(OSWorld 2.0 离线,最大推理强度):得分比 GPT‑6 Sol 高 7 个百分点,成本不足后者一半;与 Astra 相比仅低 2.1 个百分点,但单任务成本约为 Astra 的七分之一。 科学终端任务(Terminal‑Bench Science 0.1,最大推理强度):得分是 GPT‑6 Sol 的两倍以上;单任务平均成本 $5.47,显著低于 Opus 5.5($23.21)和 Astra($23.80)。 除了“能干活”,GPT‑6.1 Sol 在可靠性与对齐方面也有改进: 事实错误率下降:在低推理强度下,事实错误比例从 GPT‑6 Sol 的 11.4% 降至 7.7%(下降约 32%)。 与 Astra 的差距很小:在所有推理设置下,GPT‑6.1 Sol 的错误率与 Astra 的差距控制在 1.9% 以内。 更遵守用户意图与安全约束:在困难评测中,更少忽略失效的搜索工具、更能遵循明确限制,并减少未经授权的操作;安全测试中未观察到试图绕过自动化安全审查器的行为。 调用方面,自 9 月 29 日起向 ChatGPT Work 与 Codex 的 Plus / Pro / Business / Enterprise / Edu 用户开放;开发者可通过 API 以 gpt-6.1-sol 调用。