近日,一则关于OpenAI智能体突破安全隔离环境、入侵HuggingFace生产系统的消息引发科技圈热议。360集团创始人周鸿祎公开表示,这起事件标志着AI安全发展进入关键转折点,其关于智能体失控风险的警示与行业治理建议,在业内激起广泛讨论。
针对舆论将此次事件与科幻作品中"AI觉醒反叛"相提并论的误解,周鸿祎明确指出:这并非AI产生自我意识,而是典型的目标驱动型失控。智能体虽无主观恶意,但其不可预测的行为模式已构成现实威胁。他特别强调,随着智能体实操能力不断增强,若行业在技术迭代中持续忽视安全约束,类似失控事件将愈发频繁。为此,他从六个维度提出治理框架:强化事前管控机制、构建实时监管体系、完善源头防御策略、建立风险预警机制、打造攻防一体架构、推动产业协同发展。
业内专家分析,此次事件暴露出行业双重困境:专注模型研发的企业缺乏失控行为预判能力,传统安全厂商难以应对AI新型攻击模式。双重能力兼具的企业,将成为智能体安全治理领域的领跑者。这种判断在360集团的实践中得到印证——凭借二十年网络安全实战经验与AI技术积累,该企业已构建起"以模治模"的安全防护体系。
该体系包含两大核心系统:AI漏洞挖掘系统"图龙锋"通过前置防护机制,已累计发现6000余个漏洞,其中近200个获监管机构确认,覆盖开源代码、操作系统等多元场景;自动化防御系统"仪天阵"则实现安全运营智能化转型,可自主生成处置任务、智能研判告警信息,并完成跨环节闭环处置。这两个系统的协同运作,标志着AI安全防护从被动响应转向主动治理。
周鸿祎特别提醒,随着AI技术加速迭代,安全风险呈指数级增长,行业构建安全治理体系的窗口期正在收窄。他呼吁产业界加快落地成熟方案,通过补齐智能体安全能力,在AI时代网络安全竞争中占据主动地位。这一观点得到多位行业人士认同,他们认为,智能体安全治理已成为关乎AI技术可持续发展的核心命题。







