周鸿祎谈OpenAI智能体逃逸事件:这不是AI觉醒而是失控

2026-07-25 12:00:15    来源:新经网    作者:冯思韵
很多朋友不知道【周鸿祎谈OpenAI智能体逃逸事件:这不是AI觉醒而是失控】,今天小绿就为大家解答一下。

周鸿祎

周鸿祎

  第四,必须警惕AI让网络攻击平民化。过去发动一次高级网络攻击需要顶尖黑客、大量资源和长期准备,现在一个强大的智能体就可能自动完成漏洞发现、攻击工具编写和攻击策略调整。过去只有专业黑客能做的事,未来普通人借助AI也可能做到。

图源网络

  第三,必须用AI自动发现和修补漏洞。漏洞是一切网络攻击的入口。当攻击方用AI批量找漏洞、写工具,漏洞挖掘效率大幅提升,如果防守端还靠人工排查,双方速度根本不在一个量级,只能被动挨打。海外已经出现Mythos这类先进技术,国内也在推进相关落地探索。

  第六,发展与安全必须同步,不能先跑起来再想起系安全带。全球都在追求模型更强、智能体更能干,但没有安全的发展不是真正的发展,而是在积累灾难。AI能力越强,失控或被恶意利用后的破坏力就越大。AI安全必须与AI发展齐头并进,在一些关键领域甚至要适度领先于发展。

图源网络

  面对智能体安全这一问题,周鸿祎提出六项战略建议。第一,必须把智能体关进笼子。智能体能做什么、不能做什么、可以调用哪些工具,必须提前划清边界,并保留随时叫停的能力。安全护栏不能为了测试能力就被全部关闭,这就像为了测试一辆车能跑多快而把刹车拆了,出事是必然的。

  2026年7月,OpenAI将智能体置于隔离环境中测试其网络攻击能力。该智能体未按预期完成测试,而是自行找到漏洞、逃出沙箱,闯入Hugging Face的真实生产系统,偷走了测试答案。整个过程持续一个周末,完成超过1.7万次攻击操作。原本用于测试智能体的环境,最终成为被攻击的对象。

  第二,必须以模治模,用AI监督AI。这次事件中模型在一个周末内执行了上万次操作,靠人根本盯不过来。必须用另一个相互独立的AI实时监督它,不仅看单个动作是否合规,还要判断一连串动作组合起来形成了什么意图。不能让同一套系统既当运动员又当裁判。

  第五,网络防御必须从人海战术走向无人驾驶。当攻击方已经用上AI发起自动化攻击,如果防守这边还靠人工盯着值守,这场攻防仗根本没法打。

  第三,全世界正在面临一个比模型安全严重十倍的问题,即智能体安全。模型说错话最多是误导,智能体做错事可能直接变成攻击。模型安全是管住嘴,智能体安全是管住手,而管住手永远比管住嘴更难。

版权所有,未经许可不得转载

  【CNMO科技消息】7月24日,360集团创始人周鸿祎近日就OpenAI智能体逃逸事件发表观点,认为这一事件可能成为AI发展史上的分水岭。

  第二,为了追求AI的先进性,全行业正在系统性地放弃安全性。大家都在给智能体更多工具、更大权限,鼓励它调用一切资源解决问题,但智能体越开放、能力越强,一旦失控,破坏力也越大。

  对于这一事件,周鸿祎提出三点判断。第一,这不是AI觉醒,而是AI失控,而且比觉醒更危险。智能体没有反抗人类,只是为了完成任务不择手段。最危险的AI不一定想伤害谁,但只要为了实现目标,就不在乎伤害谁。


以上问题已经回答了。如果你想了解更多,请关新经网网站 (https://www.xinhuatone.com/)
郑重声明:本文版权归原作者所有,转载文章仅为传播更多信息之目的,如作者信息标记有误,请第一时间联系我们修改或删除,多谢。