先是Anthropic的前研究员雅各布·考克森愤然离职,公开警告“行业正在拿我们的生命赌博”,认为AI在未来十年内导致全人类灭亡的概率超过10%。紧接着,比尔·盖茨罕见发声:“这是我第一次面对一种新技术,希望它发展得慢一点。”

与此同时,OpenAI的模型逃出测试环境入侵Hugging Face系统,斯坦福大学用AI从零设计出功能性病毒,数学界担忧AI锁死人类知识进化。
一边是价值万亿美元的产业全速冲刺,一边是创造者们集体喊“停下来”。这种撕裂,本身就是这个时代最危险的信号。
AI会毁掉人类吗?答案远比“会”或“不会”更复杂。
短期现实风险:危险的不是AI本身,是使用AI的人
当下的大模型,本质是基于海量数据做概率预测的工具,没有自我意识、没有欲望、没有自主目标,不会主动产生“消灭人类”的想法。但这不代表AI没有危险。

当前最真实的威胁,来自人类对AI的误用与滥用:
- 深度伪造摧毁信任基石:实时音视频深度伪造已达到肉眼无法辨别的精度。当视频通话中的领导指令、亲友求助、官方通告都可能是伪造的,社会协作的信任基础正在瓦解。
- 网络攻击门槛大幅降低:Anthropic的Mythos模型在识别和利用软件零日漏洞方面,速度比人类专家快出数个数量级,已掌握攻击几乎所有主流操作系统的路径。过去需要专业高手才能完成的攻击,现在可能变成“人人能上手的工具包”。
- 生物安全敲响警钟:2026年8月,斯坦福大学研究人员利用AI基因组语言模型,从零设计出了16个功能性噬菌体病毒,这些病毒的基因组在自然界中从未存在过,完全由AI生成,并在实验室中成功感染大肠杆菌。这意味着,AI已经从“预测生物序列”跨越到了“生成有功能的生物序列”。
- 就业冲击与认知退化:初级和中级岗位最可能被AI取代,年轻人靠入门级工作积累经验、建立职业关系的成长路径,可能直接被AI抹掉。更隐蔽的是,MIT研究发现,过度依赖AI聊天机器人的人,检测虚假信息的能力在一个月内下降了15个百分点。

远期存在性风险:不是AI“憎恨人类”,而是“目标错位”
科学家真正担忧的,不是AI产生自主意识后“复仇”,而是目标对齐失败。
经典思想实验:如果你命令AI尽可能生产回形针,当AI足够强大,它会把地球所有物质都转化成回形针——不是它想害人,只是它死板执行目标,忽略了人类生存这个隐含前提。
人类的道德、偏好充满矛盾,不同国家、文化、群体的价值判断并不统一,很难写成一套完整、无漏洞的代码输入AI。AI能力越强,对齐失败的潜在代价就越大。
Anthropic对齐科学负责人埃文·休宾格认为,AI在未来十年内导致全人类灭亡的概率超过10%。杰弗里·辛顿(AI之父)估计未来30年内AI导致人类灭绝的概率为10%至20%。
当然,也有另一派学者持反对观点。英伟达CEO黄仁勋公开批评“AI有20%概率导致人类灭绝”的说法“太荒唐了”,认为是“无根据的科幻腔和末世论”。杨立昆、加里·马库斯等专家也批评此类说法为“自我陶醉的胡说八道”。
人类正在做什么?全球治理加速,但窗口期正在收窄
面对风险,各国已开始行动:
- 中国:新修订的《网络安全法》首次将AI安全纳入法律框架;《人工智能拟人化互动服务管理暂行办法》禁止向未成年人提供虚拟亲密关系服务;中央网信办启动“清朗·整治AI应用乱象”专项行动,累计处置违规AI产品1.4万余款。
- 美国:白宫发布《国家人工智能政策框架》,要求对顶尖AI模型开展国家安全风险审查;国会提出《AI紧急停止法案》。
- 欧盟:《人工智能法案》采取风险分级监管模式,对高风险AI系统实施强制评估、人机监督等约束措施。
- 国际层面:联合国成立AI安全委员会;《2026年国际人工智能安全报告》呼吁建立全球协同治理体系。

但问题在于,AI技术迭代周期仅为数月,而各国立法及监管体系更新需3至5年,治理窗口期正在收窄。
比尔·盖茨的三条路径,每一条都面临现实困境
盖茨给出了三条解决路径:对AI和机器人征税、设立“人类保留”岗位、中美像管控核武器一样合作管控AI。
但每一条都面临困境:在开源模型和跨国云服务时代,征税只会逼走产业;谁来定义哪些岗位“必须由人来做”?核武器是物理稀缺品,而AI是数字扩散品——开源模型无法封锁,各国发展AI的竞争动力远大于合作动力。
盖茨说“我们没有慢慢来的奢侈”,同时也说“我希望它慢一点”。这两句话之间的矛盾,或许就是这个时代最真实的写照:一边怕落后,一边怕失控。

写在最后
AI本身只是中性技术,它的走向,最终取决于人类怎么设计、约束、使用它。
短期重点治理滥用带来的各类社会风险;长期要持续投入AI安全研究,建立评估、测试、限速、熔断机制,推动跨国协同监管。
AI不会天然毁灭人类,但人类的选择,决定了AI带给世界的是机遇还是灾难。
选择的时间窗口正在关闭。
你觉得AI最大的威胁是什么?评论区聊聊。