【GPT-6刚封神三天,OpenAI首席科学家自己喊“刹车"!】美国当地时间9月6日,OpenAI首席科学家雅各布·帕乔基发表长文《An Alien Mind》,警告AI能力正加速提升,“目前没有一家实验室已经把对齐和监控做到足够可靠,可以在未来较长时间内继续以最高速度扩大模型训练。”他呼吁,在行业建立共同安全标准之前,“自愿放缓”应成为常态。
这篇长文发表于GPT-6 Astra发布仅三天后。帕乔基判断,如果沿当前路径发展,未来几年AI仍可能出现更大的能力跃升,且AI将越来越多地参与自身研发。OpenAI内部数据显示,截至8月中旬,研究团队每投入1个人类工作日,AI智能体已承担相当于3.1个工作日的任务量。中位研究员每天的智能体推理使用额已超过600美元,前10%则超过7000美元。
帕乔基认为,AI参与AI研发的“递归自我改进”正在成为现实——AI承担的工作从辅助性编码扩展到实验执行、结果分析,进而参与下一代AI开发,再推动下一轮能力增长。这一循环一旦加速,用于测试和修正模型的时间将被压缩,安全研究面临的节奏也将随之改变。
他同时指出,思维链监控的可靠性正在下降——模型推理过程已与工具调用和人机交流混合,模型甚至能分析和操纵自己的推理过程。仅靠文字输出来判断模型内部状态越来越困难。
帕乔基并未主张停止训练更强的模型,他承认更强的AI在网络安全等领域具有防御意义。但他明确表示,目前没有哪家实验室配全速往前跑。他呼吁建立行业共同安全标准,并由第三方机构参与执行。同时,各国政府需将未来AI发展的国际协调提升到更高优先级。
OpenAI CEO萨姆·奥尔特曼随后转发了这篇文章,称其为“一篇重要的文章”。外界评价不一。AI研究员David Shapiro认为,《An Alien Mind》标题夸张,但帕乔基真正提出的问题是模型能力迭代可能超过安全研究的迭代速度。