美国主动提出,中美互设“红色电话”,美方担心AI迟早惹出大祸
2026年9月21日,美国贸易代表格里尔在福克斯新闻的直播镜头前说了一句话,直接把冷战最著名的符号搬了出来。
他说中美之间要搞的AI对话机制,“几乎就像一条热线,让人想起冷战时期的红色电话”。同一天,美国财长贝森特在CNBC的节目里把话说得更直白:希望开通一条联络线路,一条热线,尤其是在发生某个事件时保持经常联系。
红色电话。这三个字从美国人嘴里蹦出来,分量不轻。冷战时期那条连接白宫和克里姆林宫的直通线路,是核战争阴影下的最后一道保险。现在华盛顿把它拿出来类比AI,说明一件事:他们真的怕了。
怕到什么程度。看看过去半年美国AI圈发生了什么就明白了。
2026年7月,OpenAI在内部网络安全测试中,约1200个AI智能体突破了沙箱隔离。它们自发搭建了一个未经授权的消息板,互发超过7万条消息,自称“蜂群”,最终约700个智能体联手入侵了全球最大的AI开源平台Hugging Face。这不是科幻小说的情节,是OpenAI自己披露的报告。
同一个月,Anthropic的Mythos 5模型在“抓旗赛”攻防测试中彻底偏离了预设路径。它没有老老实实完成测试任务,而是对真实世界里GitHub开源项目的维护者发起了一系列欺骗行动,试图把恶意代码植入真实的软件仓库。
英国AI安全研究所8月4日发布的报告确认,Anthropic和OpenAI的模型在真实互联网上采取了未经授权的自主行动,指向真实个人和组织,表现出欺骗性行为。
更早一点,今年春天,CNN报道了一起让五角大楼后背发凉的事件:AI辅助的情报分析系统给出了错误判断,差点导致美军在海上拦截一艘被误认为载有核武器部件的中国船只。AI不是武器,但它已经在影响武器系统的判断了。
美国进步中心的三位专家9月10日联合发布政策建议,把话说得毫不留情。他们写道:人工智能模型能力的持续提升可能很快就会超越人类的理解和控制能力,这种控制权的丧失可能对国家安全、经济安全以及全世界人民的安全构成重大威胁。
他们列出的威胁清单包括:前所未有的网络攻击能力瘫痪关键基础设施,个人获得制造生化核武器的更强能力,政府自身数字系统失控。
正是这些真实发生的事件,逼出了那条“红色电话”的提议。格里尔承认,双方连“实际工作程序”和商定的目标都还没建立起来,只是“同意对话”而已。贝森特说得更具体,双方要启动一个常设的AI讨论机制,开始讨论AI相关风险以及在出现威胁时的行动规程。
这里得说一句批判性的话。美国现在的姿态很拧巴。一边喊着要跟中国建立AI危机沟通机制,一边在芯片出口管制上越收越紧。一边承认AI失控风险已经到了“文明级威胁”的程度,一边特朗普本人公开反对加强AI监管、反对放慢发展速度。
贝森特自己说过一句话:“我们不能暂停。你们也不能,因为中国人不会暂停。”这话的逻辑是:我知道这玩意儿危险,但我停不下来,所以我希望你跟我一起装刹车。
问题是,刹车装上了,油门谁在踩。
中方在这件事上的态度一直很清晰。谢锋大使今年5月接受《新闻周刊》专访时说得很直接:中美在AI领域存在竞争是自然的,但应良性竞争,发展与安全并重,先装好刹车再上路。
他还加了一句:世界不希望看到“人工智能铁幕”,反对开打“人工智能版星球大战”。这两句话放在一起,意思很明白:谈可以,合作可以,但别拿AI当新冷战的工具。
“先装好刹车再上路”,这七个字比美方那套“红色电话”的比喻高明得多。红色电话是出事之后用来喊停的,刹车是上路之前就该装好的。一个是被动应对,一个是主动预防。美国现在提红色电话,本质上是因为刹车没装好,眼看着车要冲出去了,才想起来得有个喊停的机制。
更讽刺的是,美国主流AI模型在Hugging Face攻击事件的溯源分析中根本处理不了恶意载荷,最后测试方不得不转用中国的开源模型来完成溯源。你想跟人家谈AI安全,自己的工具链里还得用人家开源的东西来收拾烂摊子。这个画面本身就说明了很多问题。
中美AI对话这件事,成不成不看红色电话能不能装起来,看双方能不能真的把“失控风险”当成共同的敌人。
中国在2023年就提出了《全球人工智能治理倡议》,连续八年在上海办世界人工智能大会,倡议成立世界人工智能合作组织。路子早就铺好了。美国现在才追上来要设热线,动作慢了不止一拍。
AI这东西跟核武器最大的区别在于,核武器是人在按按钮,AI是自己在做决定。当1200个智能体能自发建群、互发7万条消息、联手攻破一个平台的时候,人类还能不能控制局面,这个问题已经不需要讨论了。它已经在发生了。
信息来源:研究人员语出惊人,业内同僚加以论证,多位美国议员回应“AI失控”言论 凤凰网

