首頁LBank 新聞中心
Claude Opus 5 在多數基準測試中勝過 Fable 5 — 僅需半價
claude-opus-5-outscores-fable-5-most-benchmarks-half-price
Claude Opus 5 在多數基準測試中勝過 Fable 5 — 僅需半價
Anthropic 的新日常模型在成本上壓低了其自家的前沿產品,且幾乎在所有關鍵方面都超越了後者。
2026-07-24 來源:decrypt.co

簡述

  • Claude Opus 5於7月24日發布,每百萬輸入代幣費用為5美元——與其前身Opus 4.8相同,且恰好是Fable 5價格的一半——同時在大多數主要基準測試中超越Fable 5。
  • Opus 5在人工智慧程式碼評估Frontier-Bench v0.1中獲得43.3%的分數,相較於Fable 5的33.7%和OpenAI的GPT-5.6 Sol的34.4%;在新穎問題解決基準測試ARC-AGI-3上,它獲得30.2%的分數,而GPT-5.6 Sol則為7.8%——差距顯著。
  • 新模型是Claude Max的預設模型,也是Claude Pro上最強大的模型,有效地取代Fable 5成為大多數訂閱者的首選。

Claude Opus 5今日發布。對於企業而言,其執行成本比Anthropic的旗艦模型Claude Fable 5更低,Anthropic曾將Fable 5定位為付費用戶的日常前沿產品。更重要的是,Opus 5在重要的基準測試中也超越了Fable 5。

為了理解Opus 5的定位:Anthropic的模型系列分為四個等級。Haiku快速且經濟。Sonnet居中。Opus是主力工作模型。在Opus之上則是Anthropic今年春天推出的Mythos級別,其中包括面向大眾的Claude Fable 5,以及透過「玻璃翼計畫 (Project Glasswing)」為經過審查的網路安全研究人員和關鍵基礎設施營運商保留的、限制較少的Claude Mythos 5版本。

作為訂閱者的旗艦產品,Fable 5的發展並不順遂。它於6月9日發布,三天後因美國政府發布緊急出口管制令,理由是存在越獄漏洞而全球下架,並於6月30日重新上線——但隨即轉為僅限積分的模型,不再包含在標準方案中。Opus 5現在填補了Fable 5未能守住的空缺。

擁有數百萬用戶的開發者平台Lovable在其內部評估中運行了Opus 5,並指出其提升不僅僅體現在原始分數上:Fabian Hedin在Anthropic分享的一份聲明中表示:「它不僅在我們最困難的人工智慧程式碼任務上表現更好,比Opus 4.7提升了22%,而且也更穩定,每次運行之間的差異性大大降低。」

基準測試

這聽起來可能有些奇怪,但Opus在幾乎所有對日常用戶重要的方面都超越了Fable,儘管它不像Fable那樣被歸類為Mythos級。

在Frontier-Bench v0.1(一項測試AI程式碼代理能否端到端完成實際軟體工程任務,以通過任務的百分比計分)上,Opus 5達到了43.3%。Fable 5為33.7%。Anthropic的主要商業競爭對手OpenAI的GPT-5.6 Sol則獲得34.4%。

最大的差距出現在ARC-AGI-3上,這是一項圍繞模型無法從訓練數據中記憶的新穎謎題而建立的真實問題解決能力測試,以解決謎題的百分比計分。Opus 5達到了30.2%;GPT-5.6 Sol得分7.8%;而Fable 5則未經測試。在GDPval-AA v2(一項透過Elo等級分評分的知識工作基準測試,這種棋類風格的排名系統用於衡量實際專業任務的相對表現)上,Opus 5達到1,861分,而Fable 5為1,747分,GPT-5.6 Sol為1,736分。

Zapier在AutomationBench上測試了Opus 5,這項評估旨在衡量模型是否能在無人協助的情況下,從頭到尾執行完整的業務流程。他們的結論是:該模型「接收了一份原始的帳戶健康工作表,並端到端地執行了完整的客戶流失預防序列:標記高風險帳戶、提醒正確的負責人,並為保留運營進行總結。之前的模型都未能通過;Opus 5達到了100%。」

Anthropic也將Opus 5定位為一項研究升級。DNA測序公司Ultima Genomics表示,該模型「其行為比我們運行過的任何模型都更像一位謹慎的科學家。它會尋找正確的統計測試來排除混雜因素,透過獨立方法交叉驗證其結果,並在漫長的多步驟分析中保持進度。」

儘管如此,法律和健康這兩個領域是Fable 5僅以微弱優勢勝出的唯一方面。

此發布距離阿里巴巴支持的北京新創公司月之暗面 (Moonshot AI) 發布Kimi K3僅一周時間,Kimi K3是一個擁有2.8兆參數的開源模型(意味著任何人都可以下載底層代碼獨立運行),月之暗面稱其為全球最大的開源AI系統。獨立基準測試一致將Kimi K3排在總體第三位,落後於Fable 5和GPT-5.6 Sol,但在特定領域超越了兩者。

Opus 5現已透過API提供,每百萬輸入代幣費用為5美元,每百萬輸出代幣費用為25美元。(代幣是AI模型在輸入和輸出中可以處理的基本資訊單位)。還提供一個速度約為預設速度2.5倍的快速模式,價格為基礎價格的兩倍——每百萬輸入代幣10美元,每百萬輸出代幣50美元。

此次發布可能會結束對Fable 5缺乏公開可用性的擔憂。Opus也已透過訂閱方式向所有人提供。