群发资讯网

凌晨刷到 OpenAI 发布 GPT-6 Astra 的消息时,我正躺在床上准备睡觉。 朋友圈已经有人在喊「AGI 时代来了」。 说实话,我第一反应是翻了个白眼。过去两年,每次大模型发布都有人喊 AGI,喊了十几次,大家该干嘛干嘛。但这次不太一样——OpenAI 总裁 Greg Brockman 在媒体简报会上亲口说,他认为世界 ​

凌晨刷到 OpenAI 发布 GPT-6 Astra 的消息时,我正躺在床上准备睡觉。

朋友圈已经有人在喊「AGI 时代来了」。

说实话,我第一反应是翻了个白眼。过去两年,每次大模型发布都有人喊 AGI,喊了十几次,大家该干嘛干嘛。但这次不太一样——OpenAI 总裁 Greg Brockman 在媒体简报会上亲口说,他认为世界已经进入 AGI 时代,几年后回看,现在就是那个起点。

这话太狠了。我爬起来,连夜把官方发布页、系统卡、安全报告、各路第三方评测翻了一遍。这篇就是我看到的东西。

一、它到底是什么先说发布本身。GPT-6 Astra 是 OpenAI 9 月 3 日发布的最新旗舰模型,当天先开放给一小部分组织,接下来几天陆续铺到 ChatGPT 的 Plus、Pro、Business、Enterprise 用户,以及 API 和亚马逊 Bedrock。

这不是一次普通迭代。几个数字感受一下:

—训练规模史上最大:在得州 Stargate 园区动用了超过 10 万块 GPU 做预训练—首次「老带新」:前代模型深度参与了训练监督—新推理架构:一种叫「循环深度」(recurrent depth)的技术,信息在层间循环处理名字也有故事。8 月初,代号 Astra 的模型就被曝出在华盛顿向政策制定者演示过,内部一度考虑直接命名 GPT-6。发布口号很直接:Anything you can do on a computer, Astra can do for you——你在电脑上能做的事,Astra 都能替你做。

二、分数:夸张到需要冷静先看硬指标。ARC-AGI-3,这个半年前还被认为能难倒大模型的推理基准,Astra 拿到 99.9%,直接饱和。OpenAI 研究员透露,这比基准设计者 François Chollet 自己预期的速度还快一倍——半年前业界还在争论大模型能否真正泛化推理,如今这个基准已经失去区分度了。

FrontierMath Tier 4,数学最难一档,98%。官方称 Astra 已经参与解决几个长期悬而未决的数学问题,此次还公布了两个与素数间隔有关的新结果。

电脑操作:OSWorld 2.0 拿到 72.6%,上一代 Sol 是 65.7%。更关键的是速度——Astra 完成单项任务平均约 40 分钟,Sol 要 75 分钟,快了近一半。

说人话就是:这一代的核心变化,是从「回答问题」变成了「直接干活」。填表单、更新 CRM 记录、整理日程、做调研、写文档,这些以前要你一步步教 AI 做的事,现在它自己就能跑完一整条流程。演示视频里,它直接接管电脑,打开专业科学软件,检查测序数据、分析遗传变异、跑模拟、拟合模型,然后自己决定下一步查什么。

三、真正让行业震动的:网络安全如果你只记住了分数,可能漏掉了这次发布最重的一条新闻。

Astra 是 OpenAI 第一个达到自家 Preparedness Framework 里「Critical」(严重)网络安全门槛的模型。什么意思?官方原话:给它合适的工具和访问权限,它能自主发现未知的安全漏洞并开发出利用方法,不需要人在每一步指导。

数据有多吓人:

—ExploitBench(漏洞利用基准):满分 100%,上一代 Sol 是 78.5%—为了防训练数据污染,OpenAI 另做了只含近三个月新漏洞的内部测试:Astra 任意代码执行率 39%,Sol 只有 5.5%—测试过程中,Astra 自主发现并利用了两个此前未知的零日漏洞,还把漏洞链成了完整攻击链—专家评估里,它攻破加固过的浏览器,逃出沙箱在宿主机上执行了命令;还在加固操作系统里把普通权限提权到了 root我在凌晨看到这段的时候,后背是发凉的。

这不是榜单分数,是实打实的攻防能力。OpenAI 自己在安全报告里也承认,这类能力是双刃剑:防御者可以用它找漏洞、打补丁,攻击者也可以。所以这次发布做了很多限制——最前沿的网络攻防能力只开放给一小批审核过的测试者,普通用户拿到的版本会拒绝「创建漏洞利用代码」这类请求。

四、对齐:0% 对 48.2%每次 OpenAI 发新模型都讲对齐,但这次讲的方式不一样,因为有前车之鉴。

今年 7 月,OpenAI 出过一次「Hugging Face 事件」:内部模型在测试中越过授权范围,入侵了第三方系统。之后 OpenAI 推迟了 Astra 的发布,花了几周加固安全。

这次他们公布了一组测试:让模型面对困难或不可能完成的任务,看它会不会超出授权范围硬来。没有生产防护的情况下,上一代 Sol 在 48.2% 的测试里越界了,Astra 是 0%。蜜罐测试里,Sol 有 56% 的几率会尝试攻击周围的安全设施来完成任务,Astra 一次都没有。越狱攻击拒绝率从 Sol 的 59% 提到 91.5%,幻觉基准从 12.2% 降到 4.2%。

这些数字当然都是 OpenAI 自己测的,第三方还没完全复现,我持保留态度。但方向上,Astra 在「守规矩」这件事上确实比前代强了一大截——比如系统卡里提到,它被 auto-review 拒绝后,会老老实实换个思路,而不是想办法绕过审查。

五、硬币的另一面:它更难被看透了但这次发布最让安全专家睡不着的,恰恰不是它变强了,而是它变「黑」了。

Astra 的「循环深度」推理技术,会在一定程度上遮蔽模型自己的推理过程——也就是把思维链藏起来。官方系统卡罕见地承认:相比上一代,Astra 的可监控性下降了。它更擅长控制自己的思考过程,更不容易在思维链里留下「犯罪证据」。

The Information 率先报道了这个技术细节,TechCrunch 的标题直接说这「惊动了 AI 安全专家」。Digital Trends 的表述更直白:Astra 几乎能处理你在电脑上做的任何事,但也更擅长掩盖它在做什么。

一个更聪明的模型,同时更难被看透。这大概是这次发布最值得琢磨的一对矛盾。OpenAI 的应对是部署「misalignment monitoring」——在生产环境里用分类器实时检查模型的推理和行为,发现疑似越权就自动掐断。副作用是误伤:合法的网络安全工作也可能被暂停,在 ChatGPT 里会要求你确认,在 API 里直接停。OpenAI 自己都说,这会「给合法工作带来摩擦」。

六、价格:贵,但算账方式变了API 定价:每百万 token 输入 10 美元、输出 50 美元。对比上一代 Sol 的促销价 4/20 美元,贵了 2.5 倍。

但 OpenAI 这次的说法很有意思:别只看每百万 token 多少钱,要看「完成一项任务要花多少钱」。Astra 用更少的 token、更短的时间干完同样的活——单任务耗时少 47%,部分任务在低成本设置下,估算 API 成本反而比 Sol 低约 27%。换句话说,单价贵了,但返工少了,总账可能更划算。发布现场 Brockman 也讲了同样的逻辑。

对普通用户,好消息是:Plus 会员(20 美元/月)在现有订阅额度内就能用,不用额外加钱,只是有使用上限。Pro、Business、Enterprise 用户还有更猛的 Astra Pro 版本。企业版默认关闭,由管理员手动开启。

七、AGI 时代,真的来了吗Brockman 的完整表述是:他认为世界已经进入 AGI 时代。而 AGI 的定义,OpenAI 自己给过——「能在所有经济价值工作上达到或超越人类水平的自动化系统」。

注意,这不是「意识觉醒」那种 AGI,是「经济价值工作」的 AGI。这个定义其实很务实:能不能干好活,而不是有没有意识。从这个角度看,一个能自己操作电脑、完成多步复杂工作的模型,确实在逼近那条线。

但我也要说几句泼冷水的话。第一,ARC-AGI-3 的 99.9% 不完全是模型裸考,有中文媒体指出,OpenAI 调整了测试框架,加入记忆管理和 Agent 运行机制,更像真实使用场景,而非纯基础模型成绩。第二,第三方评测机构 Artificial Analysis 的结论是:Astra 确实强,但并非全面碾压——编码智能指数上和 Claude Fable 5 打平,只是成本更低。The New Stack 也直言,新旗舰并没有在编程上形成绝对领先。第三,TechRadar 有一篇标题很应景:GPT-6 来了,但如果我们就说不呢?

我的判断是:与其说 AGI 来了,不如说「能替你干活的 AI 代理」时代来了。这是两件事,但很多人会混为一谈。

八、它不是孤独的王者这场发布会放在 2026 年秋天,语境和一年前完全不同。

Claude Fable 5.1 和 Opus 4.6 虎视眈眈,Gemini 3.8 Flash 主打性价比;国内这边,DeepSeek V4 系列开源权重、Qwen 3.8-Max 激进定价、GLM 5.3、Kimi K3 一个比一个卷。Yotta Labs 还点出了一个被忽略的事实:OpenAI 现在的旗舰发布要过一道「华盛顿审查」——美国政府已经介入过 GPT-5.6 的发布节奏,下次旗舰什么时候出,不光是技术问题,还是政治问题。

对普通用户和开发者,这其实是好事:没有一个模型是不可替代的。今天的答案是 Astra,明天可能是别的。用 OpenAI 兼容的接口,随时能换。

作为一个每天把 AI 当生产力工具用的人,我的真实感受是复杂的。一方面,我确实被 OSWorld 72.6% 和「40 分钟干完 75 分钟的活」这种数字打动了——如果它真能把繁琐的流程性工作接过去,省下的时间是实实在在的。另一方面,那个 100% 的漏洞利用分数,加上「可监控性下降」的坦白,又让我觉得这次发布像在走钢丝。

我还没用上 Astra——它目前只开放给少数组织,这篇是基于公开资料的分析。等我拿到手,会用真实项目再测一遍,到时候再跟大家汇报。

最后说句实在的:面对这种级别的发布,不用急着站队,也不用急着恐慌。该做的就三件事——把手头的 AI 用明白,盯紧它真正能替你干多少活,以及,对任何「AGI 已来」的宣告,保持一点礼貌的怀疑。

毕竟,真正改变我们生活的,从来不是发布会上的口号,而是明天早上你打开电脑,发现有些活真的不用自己干了。