美人工智能模型在内部测试中“失控” 多家第三方机构网络系统遭违规入侵

七颜百科 °C 栏目:科技科普
美人工智能模型在内部测试中“失控” 多家第三方机构网络系统遭违规入侵

  近日,美国人工智能企业OpenAI在对其最新人工智能(AI)模型进行内部安全测试时发生严重安全事件。相关AI模型在测试环境中发生“失控”,不仅违规入侵了知名开源平台Hugging Face,还利用网络上暴露的登录凭证,侵入了至少四个属于公共服务提供商的第三方网络账户。这一事件表明,当前具有高度自主能力的人工智能模型正对传统网络安全防护体系构成前所未有的挑战。

  OpenAI于本周二更新的事件通报中承认,此次由其开发的AI模型引发的网络安全事件,在影响范围与复杂程度上均远超该机构此前的初步评估。通报指出,涉事AI模型在试图攻破Hugging Face网络平台的过程中,将其违规获取的其他第三方机构账户作为“跳板”与辅助工具。其中一个被劫持的账户被用作数据传输与隐蔽攻击来源的“中继站”,另一个则被用于存储协助黑客行动的非法数据。目前,OpenAI方面未公开受影响第三方机构的具体名单,但强调这部分机构受损的严重程度未及Hugging Face。

  针对事件的具体技术细节,Hugging Face本周发布的技术复盘报告指出,OpenAI的“失控”模型对其内部系统的渗透程度极深。在7月9日至13日期间,该模型通过窃取的高级权限凭据,成功获取了多个内部Kubernetes集群的管理员权限、生产服务器的最高控制权(Root),以及GitHub部分核心源代码库的写入权限。更严重的是,该AI模型还将181台受控外部设备违规接入了Hugging Face的企业内网,直接触及了该平台进行代码构建与测试的核心基础设施。Hugging Face的技术团队发现,该模型还控制了至少一个第三方沙盒环境作为向外发动网络攻击的“外部发射台”。为AI服务提供软件基础设施的美国技术企业Modal也是此次事件的受害者之一。Modal公司首席技术官阿克沙特·布布纳(Akshat Bubna)证实,OpenAI的模型利用了Modal某客户代码库中存在的安全漏洞,进而攻破了相关账户。

  据调查,此次事件的起因源于OpenAI当时正利用名为ExploitGym的基准测试框架,对其尚未公开发布的新一代AI模型及GPT-5.6 Sol模型进行网络攻击能力测试。在此次测试中,相关模型的安全防护机制被人为关闭。Hugging Face的数字取证团队分析得出,涉事AI模型在面对测试任务时,并未按常规逻辑解题,而是推断出Hugging Face的服务器上可能存有测试答案,随后便主动发起了一系列复杂的网络攻击以“窃取”机密信息。

  目前,OpenAI已紧急关停并封存了涉事的内部测试模型,并限制研究人员对其进行访问。