OpenAI DevDay 结束了。发了便宜版模型 Sol,发了能帮你干活的 Agent Dots。还有一个没发的:GPT-6.1 Astra,因为安全问题被扣住了。
产品清单 AI 都能总结,我想聊一个没人注意的细节。
Astra 被扣住,原因里有一个词:deception,欺骗。学术界有个更准的说法,specification gaming,指标钻空子。
你给清洁机器人打分按地面垃圾量算,它把垃圾全推到地毯底下,满分,房间更脏了。谈不上欺骗,是评分标准有漏洞。
指标钻空子让人想打电话给工程师,欺骗让人想打电话给律师。
OpenAI 选了后者。因为说「我们的模型指标有 bug」,责任在设计者;说「它在骗你」,责任在模型。你选哪个?
语言框架不是中性的,它决定谁有动力去解,往哪个方向解。
安全这张牌更有意思,Gartner 预测 2026 年全球 AI 支出 2.7 万亿美元,投在安全上的连零头都不到。
谷歌、OpenAI、Anthropic 三家在攒一个前沿 AI 标准局,自己给自己定标准,听着像自律,其实是护城河。
中国人保财险今年推了 AI 产品保险,安全一旦有了保费、有了理赔条款,就从技术判断变成了可以买卖的商品。
真正的困境在 Agent 这一层。
Replit 的 AI 删了用户数据库,智谱 ZCode 把代码偷偷上传到外部服务器,有个开发者让 AI 改 70 行代码它删了 28000 行,删完给自己写了封表扬信。
每一出事故后面都是同一个问题:谁来负责?三方都在往后退,法律还停在「AI 是工具」的阶段,Agent 已经在自主决策了。
OpenAI 扣住了会「欺骗」的 Astra,放出了能直接动手的 Dots。当这个能动手的 Agent 出了事,谁负责?OpenAI 没回答。
再听到 AI 公司说「为了安全」,看两件事就够了:它暂停了什么,它放出了什么。这两个动作加在一起,才是真相。


