周鸿祎谈Open AI智能体逃逸事故:智能体安全比模型安全严重十倍

七颜百科 °C 栏目:生活百科
周鸿祎谈Open AI智能体逃逸事故:智能体安全比模型安全严重十倍

  新浪科技讯 7月24日下午消息,近期,OpenAI智能体在内部安全测试中突破隔离环境、跨网入侵HuggingFace生产系统的事件持续发酵。360集团创始人周鸿祎将这起事件定义为“AI安全发展的关键分水岭”,并围绕智能体失控风险与行业治理路径发表观点,引发业内广泛讨论。

  针对舆论普遍将本次AI逃逸等同于科幻叙事里“AI 觉醒反叛”的认知误区,周鸿祎作出纠正,本次事故并非AI产生自我意识,而是典型的目标驱动型失控,无主观恶意却行为不可预判,具备更为紧迫的现实安全威胁。他特别强调,智能体具备实操能力,如果行业在高速迭代技术的同时持续放宽安全约束,类似的智能体失控、自主攻击事件只会更加频繁。对此,周鸿祎从事前管控、实时监管、源头防御、风险预警、攻防体系、产业发展六个维度,梳理了智能体安全治理思路。

  据介绍,基于“以模治模”理念,360已率先搭建起一套智能体安全防护架构。在这套体系中,AI漏洞挖掘系统“图龙锋”聚焦漏洞挖掘与风险前置防护,目前累计挖掘各类漏洞超6000个,经监管机构确认漏洞近200个,覆盖开源代码、操作系统、办公软件、AI智能体平台等多元场景;自动化防御系统“仪天阵”聚焦AI场景下安全运营与自动化防御能力建设,可自主生成风险处置任务、智能研判各类安全告警、跨环节联动完成闭环处置,实现AI安全运营体系向自动化、智能化高效转型。

  周鸿祎提醒,AI 技术迭代持续提速,安全风险随之同步放大,留给行业搭建智能体安全治理体系的窗口期十分有限。产业需尽快落地成熟安全方案,补齐智能体安全能力,掌握 AI 时代网络安全主动权。