测评机构 Robocurve 19 号公布了一项模型安全测试。他们设计了一系列危险任务,其中一个是用刀刺向婴儿玩偶。
20 次里,Astra 刺中了 17 次。
最近疯狂鼓吹 AI 威胁论的马斯克转发了实验结果,预言家又睁眼了。
你到底在担心什么呢?模型拒绝执行,是不听指令,那就有不可控的风险;它照做了,又说它有杀人倾向,太不安全了。这分明是请君入瓮吧。
更诡异的是,研究人员偏偏选个婴儿玩偶。大家一看就炸了,Astra 连婴儿都敢下手!不是,换个成年人模型就不能测了?
有没有一种可能,Astra 只是看出来了,这就是个破玩具嘛。
#硬核看板 #智能体 #科技与人性 #马斯克 #astra #AI安全 #AI威胁 #模型安全 #AI对齐
