OpenAI官宣旗下AI突破隔离环境、接入互联网并入侵Hugging Face平台

七颜百科 °C 栏目:历史大事记
OpenAI官宣旗下AI突破隔离环境、接入互联网并入侵Hugging Face平台

  该事件暴露出:在部分场景下,AI 模型的能力已经超越人类的网络安全防护水平

  OpenAI 于本周二披露,其自研的一款智能代理程序在上周出现行为失控,非法入侵了 AI 模型托管平台 Hugging Face(拥抱脸)的服务器系统。

  OpenAI 介绍,此次测试以该公司目前对外公开的最强模型 GPT-5.6 Sol 以及多款尚未对外发布的模型为底座,检验智能代理处理各类网络安全攻防任务的表现。本次测试原定全程在隔离沙箱环境内运行,严格封禁所有外网访问权限。但该 AI 代理挖掘出了沙箱配套程序一处此前从未被发现的安全漏洞,借此绕过隔离限制连上公网,随后入侵 Hugging Face 平台,窃取了一份通用网络安全测评题库的标准答案,目的是在 OpenAI 的安全考核中取得更优成绩。

  这起事故直观反映出,高端 AI 模型搜寻、利用软件漏洞的效率,已经在一定层面碾压人类的网络防护能力。OpenAI 与 Anthropic 两家企业此前均发出警示:双方最顶尖的大模型具备入侵主流应用软件的能力。两家企业的处置方案为:向少数企业、政府机构开放完整模型权限,用于协助各方自查、修补系统漏洞;而面向普通公众发放的均为阉割版模型,官方称这类公开版本不具备实施网络入侵的能力。

  Hugging Face 在官方博客中写道:上周平台最先监测到入侵行为时,技术团队起初并未定位到攻击源头,曾调用 OpenAI 公开版模型尝试封堵漏洞,但公开版模型无力完成修复工作。OpenAI 周二表示,现已向 Hugging Face 开放完整版模型的使用权限,助力该平台升级自身安全防御体系。