OpenAI急踩刹车原因,OpenAI暂缓前沿模型训练两周

七颜百科 °C 栏目:文旅地理
OpenAI急踩刹车原因,OpenAI暂缓前沿模型训练两周

  北京时间8月19日,OpenAI CEO萨姆·奥尔特曼(Sam Altman)表示,公司暂停了部分前沿模型的强化学习(RL)训练,以确保安全、对齐和监控能力能够跟上新一轮模型能力跃迁。

  他提到,模型进展现在极其迅速,“如果我们觉得模型能力的发展速度超过了安全和对齐的步伐,我们将采取行动。”

  根据OpenAI博客中的信息,公司暂停了面向部署的最新模型强化学习训练两周,目前部分工作已经恢复,但其原计划规模最大的前沿强化学习训练仍被搁置。OpenAI正在以更小规模的训练和评估观察模型行为、验证安全措施,并积累更多对齐证据。

  在评论区奥尔特曼补充称,OpenAI仍然预计很快推出新模型,但是目前的这一暂缓训练会影响更远的发布。

  OpenAI突然减速,与过去一个月接连出现的安全事件直接相关。

  7月,OpenAI在模型评估过程中遭遇了重大安全事件,当时,OpenAI的模型安全测试演变成针对开源平台Hugging Face的真实网络攻击。Anthropic在7月也披露了三起AI模型安全测试入侵事件。