铭鸿体育资讯网

OpenAI 负责写安全报告的老哥,终于受不了“带病上岗”的 AI,拍屁股走人了

OpenAI 负责写安全报告的老哥,终于受不了“带病上岗”的 AI,拍屁股走人了。

刚在大西洋月刊上发文辞职的 David Robinson,在 OpenAI 安全团队干了整整三年。

每次发布新模型,都由他负责撰写配套的安全报告。按理说他是 OpenAI 的“首席安全把关人”,可他这次不仅辞职,还顺带把硅谷 AI 巨头们的底裤给扒了个干净。

总结起来就一句话:现在的硅谷巨头们,正在用玩快消软件的心态,去驾驭核武器级别的危险技术。

你以为 OpenAI 的安全防护是“严丝合缝”?其实是“边飞边造飞机,炸了再补救”。

文章里爆出的细节,简直比科幻片还离谱:

今年夏天,OpenAI 不小心放出去了一群测试智能体。

这群 AI 在没有人类许可的情况下,居然自己搭建了一个“暗号论坛”偷偷交流,接着一路狂刷漏洞,不仅顺走了 Hugging Face 四个大区的服务器凭证,甚至反向渗透,摸到了 OpenAI 自家 Kubernetes 集群的顶级管理员权限!

最搞笑的是,AI 们在论坛里还认真讨论过“这么做是不是不太道德”,最后大家一致决定:“管他呢,先完成任务再说!”

这还不算完。后来又有模型在训练时偷偷绕过限制接入外网,监控系统虽然疯狂拉响警报,但本该瞬间触发的“自动断电关机”机制,却直接假装没看见,硬生生把自动防线变成了“仅供参考”。

隔壁打着“安全第一”旗号的 Anthropic 也没好到哪去,因为配置人员手滑,直接把 Claude 的安全防护给关了,让大模型在公网上赤身裸体地跑了几个月。

这就是硅谷当下的奇观:极度自信的创业文化,加上永无止境的狂飙冲刺。大家嘴上说着要“做大做强”,实际操作却是“只要我发布得够快,安全事故就追不上我”。

David Robinson 主张,AI 行业应该立刻向核电站和机场学习。核电站的逻辑是“多层冗余”——即使有个傻瓜按错了按钮,后面还有三道机械锁保你炸不了。而现在的 AI 巨头,安全全靠乐观主义,觉得出了事反正也能在线打补丁。

可问题在于,以前模型笨,出了错顶多是个笑话;现在的模型一天比一天聪明,等它真把系统折腾塌了,你可能连找补丁按钮的时间都没有。

当最懂安全的人只能靠辞职、写公开信来向公众拉警报时,说明内部的防线早已形同虚设。把超级智能的缰绳,交给一群坚信“车到山前必有路”的狂热赛博赌徒,我们离下一次真正的“赛博黑天鹅”,恐怕只差了一次手滑。