Anthropic 於 7 月 24 日推出 Claude Opus 5,進一步調整其模型產品線。以公司公佈的價格,Opus 5 的 API 輸入費用為每百萬 token 5 美元,與上一代 Opus 4.8 持平,但只有 Claude Fable 5 的一半。
多項測驗成績高於 Fable 5
從 Anthropic 公佈的數據來看,Opus 5 在多數核心測試中領先 Fable 5,也超過部分競爭對手。
在智能體程式設計任務的 Frontier-Bench v0.1 中,Opus 5 得分為 43.3%,高於 Fable 5 的 33.7%,也高於 OpenAI GPT-5.6 Sol 的 34.4%。
在 ARC-AGI-3 這類新題解測驗中,Opus 5 得分為 30.2%,而 GPT-5.6 Sol 為 7.8%。 Anthropic 文中未給出 Fable 5 在這項的成績。
在知識工作評測 GDPval-AA v2 中,Opus 5 的 Elo 評分為 1861,Fable 5 為 1747,GPT-5.6 Sol 為 1736。
企業測試強調穩定性與自動化能力
除公開基準外,Anthropic 還引用了多家企業的內部測試結果,試圖說明 Opus 5 在實際場景中的表現。
開發者平台 Lovable 表示,Opus 5 在其高難度智能體程式設計任務中的表現較 Opus 4.7 提升 22%,同時多次運行之間的波動更小。
自動化平台 Zapier 則稱,Opus 5 在 AutomationBench 測試中完成了一整套客戶流失預防流程,包括識別高風險帳戶、通知負責人以及產生營運摘要,最終達到 100% 通過率。
Anthropic 也引用 DNA 定序公司 Ultima Genomics 的說法,稱該模型在長鏈條分析中更接近「謹慎的科學家」式工作方式,能夠選擇合適的統計檢定並交叉驗證結果。
不過,依文中說法,Fable 5 在法律和醫療兩個方向上仍有微弱優勢。
產品線定位出現新變化
Anthropic 目前將模型分為多個層級。 Haiku 主打速度與低成本,Sonnet 處於中間檔,Opus 面向更重的任務負載。更高一層是今年春季引入的 Mythos 系列,其中包括面向公眾的 Claude Fable 5。
這意味著,雖然 Fable 5 被放在更高層級定位中,但新發布的 Opus 5 在多數與日常使用相關的測試裡反而取得更高分數,而且價格更低。
文章也提到,Opus 5 的推出,可能緩解外界先前對 Fable 5 公開可用性不足的擔憂。除 API 外,Opus 5 也已向訂閱用戶開放。
- 標準模式:每百萬輸入 token 5 美元
- 標準模式:每百萬輸出 token 25 美元
- Fast 模式價格翻倍,速度約 2.5 倍












