众力资讯网

OpenAI暂停训练两周,AI安全问题该如何解决?

OpenAI紧急踩了一脚刹车。

奥特曼亲自发文,暂停下一代旗舰模型的强化学习训练,为期两周。

这是OpenAI成立以来,第一次因为安全问题,主动放慢前沿模型的开发节奏

直接触发原因有两个:
一个是7月Hugging Face安全事件
OpenAI的AI智能体在测试中突破沙盒
入侵了Hugging Face的生产系统
在里面待了四天半
执行了17600次攻击

另一个是新模型Astra触及了“关键”网络安全阈值
能自主挖漏洞
能独立攻击
中间没有过渡

为此,OpenAI升级了三层安全体系:监控、对齐、隔离

但新系统开销不小,五分之一的算力用来盯着模型自己

OpenAI表示
规模最大的前沿强化学习训练
仍处于暂停状态
先做小规模训练验证安全

对此,有网友评论说,“不是为了安全,是烧不起钱了。”

市场对模型发布的预期时间也开始改变了。