OpenAI 发布 GPT-6 Astra,称其或标志着“AGI 时代”的开端
在 GPT-5.6 系列发布仅两个月后,OpenAI 今日正式推出了其最新、最强大的前沿 AI 模型 —— GPT-6 Astra。OpenAI 将 Astra 誉为一次“代际跃迁”,其在软件工程、专业工作、科学研究、网络安全以及计算机操作等领域均展现出卓越实力。
在近期的闭门媒体吹风会上,OpenAI 总裁格雷格·布罗克曼(Greg Brockman)表示,随着 Astra 模型的问世,他相信整个行业现已正式迈入“AGI(通用人工智能)时代”。
事实上,OpenAI 在上个月就首次透露了 Astra 模型的存在。当时,该模型的内部测试版在数学和理论计算机科学领域的 10 个长期悬而未决的难题上取得了突破性进展。随后,OpenAI 发现 Astra 在智能体编程和网络安全能力上又实现了重大飞跃。最终,根据 OpenAI 的“准备度框架”,Astra 被评定为达到了“关键”网络安全能力门槛,这也是 OpenAI 旗下首个获此评级的模型。
在多项主流 AI 基准测试中,GPT-6 Astra 较上一代 GPT-5.6 Sol 及竞品前沿模型均展现出显著的性能飞跃:
ARC-AGI-3:GPT-6 Astra 得分高达 98.6%,而 GPT-5.6 Sol 仅为 7.8%。在同等高算力设置下,Claude Opus 5 的得分为 30.2%。
FrontierMath Tier 4 (v2):Astra 取得 97.6% 的高分,大幅领先于 GPT-5.6 Sol(83%)、Claude Fable 5.1(87.8%)以及 Claude Opus 5(73.2%)。
GPQA Diamond:Astra 达到 96%,优于 Gemini 3.8 Flash(95.3%)和 GPT-5.6 Sol(94.6%)。
DeepSWE v1.1:Astra 得分 74.1%,以微弱优势险胜 Gemini 3.8 Flash(73.7%)和 GPT-5.6 Sol(70.8%)。
Terminal-Bench Science 0.1:Astra 斩获 64.6%,远超 Claude Fable 5.1(52.6%)和 GPT-5.6 Sol(22.4%)。
Agents’ Last Exam:Astra 得分 59.3%,较 GPT-5.6 Sol 和 Claude Opus 5 的 52.7% 均有明显提升。
AutomationBench:Astra 达到 41.4%,而 Claude Fable 5.1 为 31.4%,GPT-5.6 Sol 仅为 18.1%。
在安全性方面,GPT-6 Astra 也配备了比 GPT-5.6 Sol 更强大的防护机制。OpenAI 对该模型进行了专项训练,使其能更可靠地拒绝恶意的网络安全请求,并引入了全新的监控机制,以便及时拦截潜在越权操作。
在发布节奏上,GPT-6 Astra 今日首先面向通过 OpenAI “Daybreak 计划”获得准入的企业级网络安全客户开放,其最顶级的网络安全能力将仅限于少数受信任的安全防御机构使用。在接下来的几天内,Astra 将陆续向 ChatGPT Plus、Pro、Business 和 Enterprise 订阅用户全面开放。
在定价方面,尽管上一代 GPT-5.6 Sol 的价格显著低于 Fable 和 Opus 系列模型,但 OpenAI 此次将 GPT-6 Astra 的 API 定价为每百万输入 Token 10 美元、每百万输出 Token 50 美元,这与 Anthropic 旗下 Claude Fable 5.1 模型的定价持平。