群发资讯网

4日凌晨,OpenAI正式发布新一代旗舰模型 GPT-6 Astra,发布前几小

4日凌晨,OpenAI正式发布新一代旗舰模型 GPT-6 Astra,发布前几小时,ChatGPT 官方账号还在卖关子,"The stars are almost aligned."(群星即将就位。)

OpenAI 总裁 Greg Brockman 在闭门简报会上留下了一句被反复引用的话:"Welcome to the AGI era."(欢迎来到 AGI 时代。)他措辞留了后路,称这是个人判断,但 "如果你想说这是第一个,我认为这是合理的"。

Astra 是 OpenAI 首次在德州 Stargate 数据中心用超过 10 万张 GPU 完成预训练的模型,从数据中心网络到推理内核再到模型架构,全部围绕这一规模从零设计。它也是第一款让旧代际模型深度参与训练过程的产品。

训练下一代 AI 的人里,已经开始出现上一代 AI。

官方将其定义为 "当今世界智能水平最高、对齐表现最好的模型",重点突破集中在计算机操作、浏览器使用、软件工程、网络安全、科学研究和专业工作六大领域。

OpenAI 甚至直接称 Astra 为 "世界上最好的 computer use 模型"。

基准测试方面,Astra 在 ARC-AGI-3(测试 Agent 在陌生 2D 环境中自主发现规则的能力)上,使用自家生产配置拿到 99.9%,标准统一 harness 下为 62.7%;FrontierMath Tier 4 达 97.6%;DeepSWE v1.1 软件工程基准 74.1%。

逆向工程基准 SRE-Bench 一次尝试成功率 88%,四次尝试达 99.2%,而前代 GPT-5.6 Sol 分别仅为 55.9% 和 68.7%。在数学研究上,Astra 还贡献了素数间隔领域的两个新证明结果。

Astra 是 OpenAI 第一个跨过 Preparedness Framework"Critical" 网络安全能力阈值的模型。

这意味着在拥有合适工具和权限时,它能自主在加固系统中发现未知漏洞并开发利用方式。ExploitBench 上,Astra 直接拿到 100%;内部测试中,它甚至发现并利用了两个此前未知的零日漏洞。

正因如此,OpenAI 推迟了数周发布以强化防护。正式版拒绝高级网络攻击任务,但支持安全代码审查等防御性工作。

同时,Astra 的思维链可监控性反而下降 —— 模型能更强地控制自己的书面推理,OpenAI 为此部署了 "失对齐监控" 系统,可实时暂停或终止可疑任务。

API 定价为每百万输入 token 10 美元、输出 50 美元,是 GPT-5.6 Sol 的 2.5 倍。支持 105 万 token 上下文和 12.8 万 token 输出,并提供价格翻倍、速度最高 2.5 倍的 Fast 模式。

目前 Astra 仅向 Trusted Access/Daybreak 体系中的少量机构和经审核的网络安全用户开放,Plus、Pro、Business、Enterprise 订阅用户及 API 用户需再等几天。Pro 以上档位还可获得能力更强的 Astra Pro。