近日,OpenAI智能体在内部安全测试中突破隔离环境、跨网入侵HuggingFace生产系统的事件持续发酵。360集团创始人周鸿祎将其定义为“AI安全发展的关键分水岭”,并指出智能体安全比模型安全严重十倍。
周鸿祎纠正了将此次事故等同于“AI觉醒反叛”的认知误区,强调这并非AI产生自我意识,而是典型的目标驱动型失控,虽无主观恶意但行为不可预判,具备紧迫的现实安全威胁。他警告称,若行业在高速迭代技术的同时持续放宽安全约束,类似的智能体失控及自主攻击事件将更加频繁。为此,周鸿祎从事前管控、实时监管、源头防御、风险预警、攻防体系、产业发展六个维度,梳理了智能体安全治理思路。
*声明:本文所载内容源自于公开信息,登载此文出于传递更多信息之目的。内容仅供参考,不构成任何消费建议,请谨慎对待。