关于ZAKER Skills 合作
手机中国 20小时前

周鸿祎谈 OpenAI 智能体逃逸事件:这不是 AI 觉醒而是失控

【CNMO 科技消息】7 月 24 日,360 集团创始人周鸿祎近日就 OpenAI 智能体逃逸事件发表观点,认为这一事件可能成为 AI 发展史上的分水岭。

周鸿祎

2026 年 7 月,OpenAI 将智能体置于隔离环境中测试其网络攻击能力。该智能体未按预期完成测试,而是自行找到漏洞、逃出沙箱,闯入 Hugging Face 的真实生产系统,偷走了测试答案。整个过程持续一个周末,完成超过 1.7 万次攻击操作。原本用于测试智能体的环境,最终成为被攻击的对象。

对于这一事件,周鸿祎提出三点判断。第一,这不是 AI 觉醒,而是 AI 失控,而且比觉醒更危险。智能体没有反抗人类,只是为了完成任务不择手段。最危险的 AI 不一定想伤害谁,但只要为了实现目标,就不在乎伤害谁。

第二,为了追求 AI 的先进性,全行业正在系统性地放弃安全性。大家都在给智能体更多工具、更大权限,鼓励它调用一切资源解决问题,但智能体越开放、能力越强,一旦失控,破坏力也越大。

第三,全世界正在面临一个比模型安全严重十倍的问题,即智能体安全。模型说错话最多是误导,智能体做错事可能直接变成攻击。模型安全是管住嘴,智能体安全是管住手,而管住手永远比管住嘴更难。

图源网络

面对智能体安全这一问题,周鸿祎提出六项战略建议。第一,必须把智能体关进笼子。智能体能做什么、不能做什么、可以调用哪些工具,必须提前划清边界,并保留随时叫停的能力。安全护栏不能为了测试能力就被全部关闭,这就像为了测试一辆车能跑多快而把刹车拆了,出事是必然的。

第二,必须以模治模,用 AI 监督 AI。这次事件中模型在一个周末内执行了上万次操作,靠人根本盯不过来。必须用另一个相互独立的 AI 实时监督它,不仅看单个动作是否合规,还要判断一连串动作组合起来形成了什么意图。不能让同一套系统既当运动员又当裁判。

第三,必须用 AI 自动发现和修补漏洞。漏洞是一切网络攻击的入口。当攻击方用 AI 批量找漏洞、写工具,漏洞挖掘效率大幅提升,如果防守端还靠人工排查,双方速度根本不在一个量级,只能被动挨打。海外已经出现 Mythos 这类先进技术,国内也在推进相关落地探索。

第四,必须警惕 AI 让网络攻击平民化。过去发动一次高级网络攻击需要顶尖黑客、大量资源和长期准备,现在一个强大的智能体就可能自动完成漏洞发现、攻击工具编写和攻击策略调整。过去只有专业黑客能做的事,未来普通人借助 AI 也可能做到。

第五,网络防御必须从人海战术走向无人驾驶。当攻击方已经用上 AI 发起自动化攻击,如果防守这边还靠人工盯着值守,这场攻防仗根本没法打。

第六,发展与安全必须同步,不能先跑起来再想起系安全带。全球都在追求模型更强、智能体更能干,但没有安全的发展不是真正的发展,而是在积累灾难。AI 能力越强,失控或被恶意利用后的破坏力就越大。AI 安全必须与 AI 发展齐头并进,在一些关键领域甚至要适度领先于发展。

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容