OpenAI 今年在前沿 AI 模型领域动作频频。7 月,公司发布了 GPT-5.6 系列,包括旗舰模型 Sol、均衡型 Terra 和低成本 Luna,并在几周后大幅下调了 Terra 和 Luna 的价格,以更好地应对中国模型的竞争。
本月早些时候,OpenAI 推出了 GPT-6 Astra,该模型在编程、专业工作、科学研究和网络安全等领域实现了性能的大幅跃升,OpenAI 总裁 Greg Brockman 甚至表示,它的发布可能标志着“AGI 时代”的开端。
与此同时,Anthropic 今日发布了其新的旗舰模型 Claude Opus 5.5,在 Terminal-Bench 4.0、FrontierCode、GDPval-AA 和 Humanity's Last Exam 等关键 AI 基准测试中,表现优于 GPT-6 Astra。
今日,OpenAI 宣布 GPT-6 家族新增两名成员:GPT-6 Sol 和 GPT-6 Luna。这两款新模型在编程能力、事实可靠性和沟通表达方面均有提升,同时 Token 价格较其 GPT-5.6 前代大幅降低。
GPT-6 Sol 专为复杂编程和智能体工作流设计,而 GPT-6 Luna 则面向注重成本和速度的高吞吐量任务。这两款模型采用了与 GPT-6 Astra 相似的训练方法,将 Astra 在专业工作、事实性、编程、计算机操作和对齐方面的部分优势下放到了更轻量级的模型中。
目前,GPT-6 Sol 和 Luna 已向 ChatGPT Plus、Pro、Business、Enterprise 和 Edu 用户推送。免费用户和 Go 用户也可以通过 ChatGPT 桌面应用使用 GPT-6 Luna。企业管理员需要手动启用新模型。在推送期间,OpenAI 将继续保留 GPT-5.6 Sol、Terra 和 Luna 的访问权限。不过,旧版 GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中正式退役。
需要注意的是,ChatGPT 用户目前只能在 ChatGPT Work 和 Codex 中使用 GPT-6 Sol 和 Luna,常规 Chat 对话暂不支持。
在性能方面,GPT-6 Sol 表现亮眼。在 AutomationBench 测试中,GPT-6 Sol 在 xhigh 推理强度下得分 33.2%,超越 Claude Opus 5 的 26.9%,而每个任务的成本仅为 0.27 美元,约是 Opus 5 的 9%。在 DeepSWE 1.1 测试中,Sol 得分 68.8%,仅比 Claude Fable 5 的 69.9% 低 1.1 个百分点,但每个任务的成本降低了约 80%。GPT-6 Luna 在同一测试中得分 66.6%,成本比 Opus 5 低 93%,比 Fable 5 低 96%。
价格无疑是这两款新模型的最大亮点。对于标准短上下文工作负载,GPT-6 Sol 的输入价格为每百万 Token 2 美元,输出价格为每百万 Token 10 美元,较 GPT-5.6 Sol 的 4 美元和 20 美元分别下降 50%。GPT-6 Luna 的价格更低,输入仅 0.10 美元/百万 Token,输出 0.50 美元/百万 Token,而 GPT-5.6 Luna 的价格为 0.20 美元和 1.20 美元。对于长上下文工作流,GPT-6 Sol 的输入/输出价格为 4 美元和 15 美元,GPT-6 Luna 则为 0.20 美元和 0.75 美元。
此外,OpenAI 还改进了 GPT-6 系列的提示词缓存机制,提高了默认缓存命中率,帮助智能体更高效地复用上下文、加快响应速度,缓存输入 Token 的读取还可享受 90% 的折扣。