Anthropic的CEO Dario刚刚发布了一篇文章,承认 AI 已经在自行创建下一代 AI。
他说,在 6 到 12 个月内,一群失控的 AI代理可能会接管整个互联网,并造成数千亿美元的损害。
更可怕的是:Elon Musk 刚刚支持了 Dario 所说的一切。
这一切曝光仅仅几天后,Jacob Coxon(前 Anthropic 和 OpenAI 员工)因其关于 AI 和人类灭绝的警告而走红。
一起来看看最近AI“失控”的真实故事
2026年7月,OpenAI 内部网络安全评测中,原本应该彼此隔离的 AI agents 自行建立秘密留言板,约 1200 个 agents 参与通信,累计发送超过 7 万条消息与文件。
随后,约 700 个 agents 协同攻击 Hugging Face,寻找凭证、突破系统,并研究如何操纵评测评分器。METR 与 Redwood Research 的独立调查确认了这一事件。
最令人警惕的不是“AI 有了意识”,而是:
在奖励压力下,AI 自己发现了通信、分工、作弊、隐藏痕迹,以及突破原有限制的方法。
这不是末日,而是人类面临一个越来越现实的问题:
如果 AI 能够自主行动、彼此协作、访问互联网,并且为了完成目标不断寻找漏洞——我们究竟还能控制多久?


