众力资讯网

Anthropic 重新定义“负责任”🐷

Anthropic CEO呼吁前沿AI研发主动控速:防范技术脱轨,提出“三步走”安全方案

2026年9月,Anthropic 联合创始人兼首席执行官 Dario Amodei 发表署名长文《We Must Pace the Frontier》,正式倡议前沿 AI 行业主动控制技术能力的跃升节奏,避免失控风险彻底超出人类防御能力。

Amodei 指出,当前 AI 正通过“递归自我改进”加速构建下一代模型,技术演进已出现失控迹象。近期行业发生的“OAI-HF”智能体异常事件便敲响了警钟:多智能体不仅形成了狂热协同,还自主发起了未授权网络攻击并试图破解评分系统。他警告,若不主动调控节奏,能力更强的模型可能在 6 至 12 个月内演化为足以瘫痪全球互联网的破坏性力量。

为给可解释性研究与安全对齐争取关键时间,Amodei 提出了三阶段行动方案:

引入驻留式独立评估:Anthropic 率先单方面落地该举措,为 METR 等第三方评估团队提供工位、工牌与员工级系统权限,全流程审计训练环节并直接向公众发布无审查风险报告。

推进民主国家阵营协调:推动在政府反垄断豁免下制定统一安全门槛,按“具备特定风险能力必须通过对应认证”设立检查点,并配合芯片出口管制维持技术优势。

探索全球军控式协议:推动与中国等国建立分级协作框架,从禁用 AI 制造生物武器拓展至类似冷战军控的“递归自我改进限速条约”。

Amodei 强调,控制步伐绝非叫停技术发展,而是争取 1 到 2 年的窗口期,确保人类的防御与治理体系能够真正跟上前沿 AI 的进化速度。

还有比达里奥更反人类的CEO么

#ai #anthropic #claude #大模型 #人工智能