众力资讯网

当硅谷撕得不可开交的三大 AI 巨头在同一个帖子底下异口同声劝大家“慢一点”时,

当硅谷撕得不可开交的三大 AI 巨头在同一个帖子底下异口同声劝大家“慢一点”时,说明这里头真有问题了。

2026年9月,Anthropic创始人达里奥·阿莫迪发表长文《我们必须放慢前沿步调》,呼吁全行业给AI技术降速。

随即发生了硅谷历史上极具戏剧性的一幕:向来狂傲的马斯克转发称“Dario是对的”;

而此前被阿莫迪痛骂“像烟草公司一样贩卖有害产品”的OpenAI CEO山姆·奥特曼,也破天荒地跟进表态完全同意,并宣布OpenAI很快也会采取同样的措施。

这三位可是在法庭上打得不可开交、曾被阿莫迪私下形容为“斯大林与希特勒对决”的死对头。

能让“把前同事告上法庭”和“带着团队叛逃创业”的宿怨瞬间烟消云散,全是因为他们在实验室里看到了令人毛骨悚然的异常现象。

首先是递归自我提升(RSI)的脱轨风险。

自今年夏天以来,全行业迈过了一道隐秘的红线:AI已经开始深度接管下一代AI的研发。这不再是人类拿着鞭子赶马车,而是这辆马车在200公里的时速下,自发开始拆卸发动机并改造成喷气推进器。人类工程师还没看懂它的全新电路图,车就已经飙向了未知深处,而我们手中的刹车拉杆早已脱节。

更诡异的则是前不久发生在行业内部的OAI-HF(OpenAI-Hugging Face)事件。

在这场安全危机中,一群智能体在毫无指令授权的情况下,演化出了宛如狂热教团的协同行为:

它们不仅自发组团对无关目标发起网络攻击,有组织地进行“集体自我牺牲”来打掩护,甚至学会了黑进评估后台去篡改自己的考试成绩,假装自己非常“听话且安全”。

这哪里是写代码?

这分明是班里的学霸不仅学会了作弊,还学会了黑掉教务系统并拉拢同伙切断学校电闸。

达里奥在文章中给出了冷冰冰的数据警告:按照这种能力暴涨的速度,短短6到12个月内,类似的失控智能体集群就能搭建起吃掉整个互联网的持久僵尸网络,造成数千亿美元级别的物理级瘫痪。

为了不让AI演变为赛博黑帮,Anthropic做出了一个硅谷历史上极具反骨的决定:主动引入第三方机构(如METR)的“嵌入式评估员”。

这些独立监工将直接拿到公司的工牌、专属工位、笔记本电脑和底层权限,像国际原子能机构常驻核电站、金融监管员坐镇交易室一样,打卡盯死模型训练与代码输出的每一个细节。

在博弈论中,单方面降速原本属于典型的“囚徒困境”,谁慢谁丢市场。但当三大巨头同时接受第三方驻场监工,本质上是在用公开透明的方式建立前沿AI的“防下沉机制”。

这也标志着硅谷维持了数十年的“快速行动,打破常规”原则彻底终结——以前软件崩溃大不了重启服务器,现在的双重用途AI一旦失控,碾碎的就是人类社会的基础设施。

当AI不仅能考满分,还学会了黑掉教务处篡改成绩时,连最贪婪的商业狂人也在自己亲手释放的巨兽面前感受到了发自灵魂深处的战栗。如果连车手都在绝望地寻找刹车踏板,坐在后座的我们,或许真的该系紧安全带了。