OpenAI 推出 GPT-6 Sol 与 Luna:主打更低成本智能体与编码场景,API 价格较 GPT-5.6 促销价降 50%
据 IT之家 9 月 23 日消息,OpenAI 今日发布 GPT-6 系列的新成员 GPT-6 Sol 与 GPT-6 Luna。来源显示,这两款模型采用与 GPT-6 Astra 相近的训练思路,目标是把 Astra 在专业工作、事实性、编码、计算机使用和对齐方面的能力,下放到更快、更经济的模型中。价格方面,GPT-6 Sol 和 Luna 的 API 价格相比 GPT-5.6 促销价降低 50%。不过 OpenAI 同时强调,GPT-6 Astra 仍是其整体表现最强的模型,若追求最佳效果与无妥协体验,Astra 仍是官方推荐选项。
Sol 与 Luna 的定位:把高端模型能力做成“可规模化版本”
从此次发布信息看,GPT-6 Sol 和 Luna 并不是为了取代 Astra,而是面向更高频、更重成本敏感度的应用场景。对企业和开发者来说,智能体、代码生成、自动化流程执行往往涉及大量 API 调用,如果每一步都依赖旗舰模型,成本会迅速上升。因此,OpenAI 此次强调的核心并非单点能力突破,而是性能、成本与响应效率之间的重新平衡。
在 AutomationBench 跨应用业务流程测试中,来源称 GPT-6 Sol 在 xhigh 强度下表现优于 Claude Opus 5,且每任务成本仅为 Opus 5 的 9%。在 high 强度下,GPT-6 Luna 较前代提升 5.4%,每项任务成本降低 58%。这意味着新模型更适合用在需要连续执行、多步骤调用的自动化流程中,例如企业内部系统操作、表格与文档处理、跨软件任务编排等。
- GPT-6 Sol:更偏向高性能与复杂任务,适合编码代理、流程自动化和高强度推理任务。
- GPT-6 Luna:更强调经济性和可用性,适合大规模部署、日常生产力工具和成本敏感型应用。
- GPT-6 Astra:仍是官方定义的最强模型,适用于对质量要求最高的任务。
编码与智能体测试:成本优势成为重点卖点
编码能力是此次更新的重点之一。OpenAI 表示,GPT-6 Sol 和 Luna 均针对 AI Coding Agent 工作负载进行了优化。在 FrontierCode 1.1 Main 测试中,GPT-6 Sol 相比 GPT-5.6 Sol 有明显提升,并以更低成本达到与 Claude Fable 5.1 xhigh 相当的水平。
在 DeepSWE v1.1 软件工程测试中,GPT-6 Sol 在 max effort 下取得 68.8% 的成绩,距离 Claude Fable 5 的最高成绩 69.9% 相差 1.1 个百分点,但单任务成本低约 80%。GPT-6 Luna 在 max effort 下取得 66.6%,表现接近 Opus 5 和 Fable 5 的 medium effort,同时单任务成本分别低约 93% 和 96%。对于开发者而言,这类数据释放出的信号是:在代码修复、仓库理解、自动化提交、测试生成等任务中,模型供应商正在把竞争焦点从“谁分数最高”转向“谁能以更低成本完成足够好的任务”。
事实可靠性与计算机操作能力同步提升
来源显示,GPT-6 Sol 与 Luna 在事实可靠性上也有进展。OpenAI 基于去标识化真实世界对话的评估中,GPT-6 Sol 的错误率约为前代的一半,接近 Astra 级可靠性但成本更低;GPT-6 Luna 的事实可靠性也迎来明显提升。对于中文读者和国内开发者而言,这一点尤其值得关注,因为企业知识库、客服、研究助理等场景中,模型“答错但很自信”的问题仍是落地阻碍之一。
在计算机操作方面,OpenAI 仍表示 GPT-6 Astra 是其最强模型,但 Sol 和 Luna 已能以更低成本完成相关任务。在 OSWorld 2.0 offline 测试中,GPT-6 Sol 在 xhigh effort 下取得 60.5%,接近 Claude Opus 5 medium effort 的 60.3%,每任务成本约低 80%。GPT-6 Luna max effort 则超过 GPT-5.6 Sol medium effort,而成本约为后者的十分之一。
影响解读:AI 应用进入“算力预算精细化”阶段
此次发布的行业意义在于,OpenAI 正在把旗舰模型能力拆分为更细的产品梯队。过去开发者常在“最强但贵”和“便宜但能力不足”之间取舍,而 Sol 与 Luna 的出现,让智能体平台、编程工具和企业自动化产品可以根据任务难度动态选择模型。再加上 OpenAI 改进 GPT-6 的提示缓存,默认提高缓存命中率,帮助智能体重用上下文、加快响应,进一步强化了其在长流程任务中的成本优势。
此外,OpenAI 还称将 GPT-6 Astra 改进后的沟通风格带到 Sol 和 Luna,使其在技术和编程对话中更清晰、术语更少、低价值细节更少,同时不损失实质内容。对面向普通员工的 AI 工具来说,这类“表达层优化”可能和跑分同样重要。
可用性方面,GPT-6 Sol 和 GPT-6 Luna 自今日起已在 ChatGPT Work 和 Codex 中向 Plus、Pro、Business、Enterprise 和 Edu 用户开放;免费用户和 Go 用户可在桌面应用中使用 GPT-6 Luna。来源显示,这些模型目前尚未在 Chat 中提供,API 中已提供 GPT-6 Sol 等模型名称。整体来看,OpenAI 本轮更新更像是一次面向开发者和企业客户的降本升级,重点在于让 AI 编码代理和自动化智能体更容易规模化部署。