Anthropic 首席执行官 Dario Amodei 发布最新博客,提出应放缓前沿 AI 模型能力提升速度,并给出三项推进方向。近期 AI 安全争论再度升温,模型能力加速提升,也让行业内部对风险控制的讨论明显增多。
Anthropic先承诺引入驻场评估
Amodei 提出的第一项措施,是让第三方机构派出“驻场评估人员”进入 AI 公司,核查企业是否遵守既有安全承诺,并监督安全事件是否被及时上报。
他举例称,这类安排可由类似 METR 的外部组织承担。相关人员将获得公司工牌、办公桌和电脑,接触范围大体接近企业内部风险评估团队,但在法律或合同限制下会有例外。Amodei 表示,Anthropic 将单方面先行推进这一做法,同时呼吁政府要求其他前沿 AI 公司跟进。
呼吁头部公司协调安全标准
第二项方向,是由“民主国家”的领先 AI 公司协调制定共同安全标准,并对未经控制的能力提升速度设限。Amodei 认为,这类讨论最好由美国政府出面协调,或至少提供有限豁免,以降低企业因反垄断问题而不愿沟通的顾虑。
这一表态也回应了行业现实。当前头部模型公司竞争激烈,企业之间关系紧张,若直接讨论同步放缓研发,可能面临监管审查风险。Amodei 的说法是,政府不一定需要直接参与,但应为特定安全议题的沟通创造条件。
将中国因素纳入方案
对于“放缓研发会让中国赶上”的常见反对意见,Amodei 也给出回应。他认为,如果美国政府与科技公司继续限制高性能芯片和半导体制造设备流向中国,并打击模型蒸馏等做法,美国有机会在未来 3 到 5 年进一步扩大领先优势。
在此基础上,他还提出第三项方向,即推动全球层面的有限协调。按他的说法,美国及其盟友应尽可能与威权政府展开接触,其中也包括与中国合作,重点不是全面协同,而是先在少数高风险用途上寻求共识,例如限制 AI 被用于生物武器制造。
安全争论仍在扩大
这份表态发布前,Anthropic 已因内部研究人员对 AI 风险的公开批评而受到关注。Amodei 在文中没有直接回应个别离职事件,但提到两项变化让他更倾向谨慎推进:一是 OpenAI 与 Hugging Face 相关安全事件,二是近几个月 AI 在构建下一代 AI 方面的能力提升明显加快。
不过,这套方案也面临两类质疑。一部分支持加速发展的声音认为,Amodei 过度强调长期灾难风险,助长了行业反弹情绪;另一部分批评者则认为,这类主张可能让头部公司借安全名义强化自身地位,而忽视 AI 已经造成的现实问题。
Amodei 在文中表示,他仍相信 AI 能显著改善人类生活质量,但前提是以更谨慎的方式推进开发,并把争取到的时间真正用于安全建设。









