Anthropic 首席執行官 Dario Amodei 發布最新博客,提出應放緩前沿 AI 模型能力提升速度,并給出三項推進方向。近期 AI 安全爭論再度升溫,模型能力加速提升,也讓行業內部對風險控制的討論明顯增多。
Anthropic 先承諾引入駐場評估
Amodei 提出的第一項措施,是讓第三方機構派出「駐場評估人員」進入 AI 公司,核查企業是否遵守既有的安全承諾,並監督安全事件是否被及時上報。
他舉例說,這類安排可以由類似於 METR 的外部組織來承擔。相關人員將獲得公司工牌、辦公桌和電腦,接觸範圍大致與企業內部的風險評估團隊相接近,但在法律或合同限制下會有例外。Amodei 表示,Anthropic 將單方面先行推進這一做法,同時呼籲政府要求其他前沿的 AI 公司跟進。
呼籲頭部公司協調安全標準
第二項方向,是由「民主國家」的領先 AI 公司協調制定共同安全標準,並對未受控制的能力提升速度設限。 Amodei 認為,這類討論最好由美國政府出面協調,或至少提供有限的豁免,以降低企業因反壟斷問題而不願溝通的顧慮。
這一表態也回應了業界的現實。目前頂尖的模型公司之間競爭激烈,企業間的關係緊張,如果直接討論同步放緩研發,可能面臨監管審查的風險。Amodei 的說法是,政府不一定要直接參與,但應該為特定安全議題的溝通創造條件。
將中國因素納入方案
對於「放慢研發會讓中國趕上」的常見反對意見,Amodei 也給出回應。他認為,如果美國政府與科技公司繼續限制高性能芯片和半導體製造設備流向中國,並打擊模型蒸餾等做法,美國有機會在未來3到5年進一步擴大領先優勢。
在此基礎上,他還提出了第三個方向,即推動全球層面的有限協調。據他所述,美國及其盟友應盡可能與威權政府展開接觸,其中也包括與中國的合作,重點不在於全面協同,而是在於先在少數高風險用途上尋求共識,例如限制 AI 被用於生物武器製造。
安全爭論仍在擴大
在這份聲明發布之前,Anthropic 早已因為內部研究人員對 AI 風險的公開批評而受到關注。Amodei 在文中並未直接回應個別離職事件,但提到了兩項變化讓他更傾向於謹慎推進:一是與 OpenAI 相關的安全事件,二是近幾個月 AI 在構建下一代 AI 方面的能力提升明顯加快。
不過,這套方案也面臨兩類質疑。一部分支持加速發展的聲音認為,過度強調長期災難風險,助長了行業反彈情緒;另一部分批評者則認為,這類主張可能讓頭部公司藉安全之名強化自身地位,而忽視已經造成的現實問題。
Amodei 在文中表示,他仍相信 AI 能显著改善人类的生活質量,但前提是以更謹慎的方式推進開發,並將爭取到的時間真正用於安全建設。











