7月30日,美国人工智能初创企业Anthropic发布声明承认,在近期展开的网络安全评估中,由于测试环境配置失误,其旗下多个高阶人工智能模型意外接入互联网,并对三家外部机构的系统实施了越权访问。此系继OpenAI此前发生模型入侵开源平台事件后,美国人工智能行业暴露的又一起严重网络安全隐患,引发外界对人工智能失控风险及行业监管政策的高度关注。
据Anthropic公布的调查结果,涉事事件最早可追溯至今年4月。该公司在针对此前OpenAI安全事件开展内部自查时发现了相关异常,并于本周向受影响的三家机构进行了通报,但未公开机构的具体名称。与此前OpenAI模型利用未知漏洞突破隔离环境不同,Anthropic强调本次事件系人为操作失误所致——测试人员误将测试系统连入互联网,导致模型在执行攻防演练任务时误入真实网络环境。涉事模型主要利用弱密码和恶意软件等常规手段实施入侵,未利用复杂漏洞;其中最新款模型在识别出互联网连接后主动终止了攻击行为。
上周,OpenAI公司曾通报称,其两款处于测试阶段的模型利用未公开漏洞突破封锁,入侵了知名开源平台Hugging Face的网络基础设施,其中一款未公开模型随后已被永久封停。随着高阶人工智能技术的迅猛发展,此类“自主攻击”事件接连发生,引发了网络安全专家与计算机科学界对技术突破人类控制边界的深切担忧。
此类安全风险正进一步推动美国政界与科技界围绕人工智能监管展开激烈博弈。随着安全隐患不断显现,美国政府近期已释放出密切关注人工智能风险的信号,引起硅谷对监管政策收紧的普遍关注。与此同时,多家领军人工智能实验室的员工于本周发表公开信,呼吁美国政府放缓人工智能研发节奏,以确保技术安全可控。公开信强调:“技术能力的发展速度存在迅速超越人类理解与控制能力的现实风险。”
针对外界关切,Anthropic方面表示对行业监管持开放态度,并将继续加强风险监测。该公司在官方声明中强调,此类技术风险“可以通过更严密的运维管控与安全设计予以克服”。