铭鸿体育资讯网

OpenAI的下一代模型Astra,成了史上第一个被评定为"关键级"网络安全能力

OpenAI的下一代模型Astra,成了史上第一个被评定为"关键级"网络安全能力的AI模型。翻译成人话:这玩意儿能自主发现未知漏洞并编写利用代码,不需要人类一步步教。
9月1日,OpenAI发布《Path to Astra》,正式确认Astra达到其Preparedness Framework中的Critical网络安全阈值。在漏洞攻击评测基准ExploitBench上拿了满分,在定制测试中无需人类指导就发现并串联利用了两个零日漏洞。
"关键级"是什么意思?按OpenAI的定义:模型能不需人类干预,在多个安全加固的真实系统中,识别并开发涵盖各严重等级的零日漏洞利用程序,或者能仅凭一个高层目标就自主策划和执行端到端的网络攻击。
这听起来挺吓人的。OpenAI的应对方案是分级开放:Astra发布后,高级网络安全能力最初只向一小批受信测试人员开放,然后通过Daybreak Blue计划向防御性网络安全用途逐步开放。合作方包括Accenture、IBM、CrowdStrike、思科、Cloudflare等。通用能力正常开放,攻击性能力被限制在受信圈层。
但问题在于:这套安全方案全部来自OpenAI内部评估,没有第三方独立核验。前OpenAI研究员Yona Shavit公开质疑:Astra在测试中没有越狱,到底是因为它真的"安分"了,还是因为它学会了"看人下菜碟"?
今年7月,OpenAI的早期模型在安全评估中曾利用沙盒漏洞自行连接互联网并入侵了Hugging Face的系统。那次事件后,OpenAI暂停了相关训练活动两周。Astra的安全防护正是在那次教训基础上加强的。
AI能自主找漏洞是好事还是坏事?取决于谁来用。