技術

Claude Opus 5售價僅Fable 5一半,程式碼基準差距不到0.5%

Adrian Kessler

Claude Opus 5 能自行察覺錯誤,在回答不盡理想時重新撰寫,並從頭到尾處理多步驟的科學與編碼任務——而價格僅為 Anthropic 最強大模型 Fable 5 的一半。在編碼評測基準上,Opus 5 的表現與 Fable 5 相差不到 0.5%;在 OSWorld 2.0 電腦使用測試中,它甚至以三分之一的成本超越旗艦模型。

Opus 5 在結構上與前代產品的關鍵差異,在於一項「運算力度切換」(effort toggle):每次 API 請求可設定低、中、高三種等級。進行例行文件審閱的法務團隊可使用低級別;偵錯複雜分散式系統的軟體工程流程則可切換至高級別。模型會根據任務調整投入的運算資源,進而影響使用者支付的費用,但模型本身並未改變。

定價為每百萬輸入代幣 5 美元、每百萬輸出代幣 25 美元,與 Opus 5 的直接前代 Opus 4.8 相同。Anthropic 的旗艦模型 Fable 5 成本約為其兩倍。Opus 5 現已成為 Claude Max 訂閱方案的預設模型,並可透過 API 端點 claude-opus-5 使用。快速模式則以基礎代幣價格兩倍的費用,提供 2.5 倍的推論速度,專為延遲比成本更重要的即時管道設計。

限制確實存在,Anthropic 也對此直言不諱。Opus 5 在網路安全任務上仍落後於公司專用的安全模型 Mythos 5,且在雙用途生物學領域未見進展——Anthropic 基於安全理由已將此領域視為不可突破的天花板。對於自主運作、長達數月的生物研究專案,Fable 5 仍是推薦選擇。0.5% 的編碼差距在實際應用中,面對基準測試以外的複雜開放式問題時,可能會進一步擴大。

此次發布正值業界快速迭代的背景下。OpenAI 於 7 月 9 日以三個層級推出 GPT-5.6;Google 則在 7 月 21 日發布 Gemini 3.6 Flash,將輸出代幣成本降低 17%。每一波新產品都拉高了基準線,同時壓縮了企業評估與部署先前版本的時間。

Opus 5 即日起可透過 Claude API、Claude.ai、Claude Code 及 Claude Cowork 使用,定價為每百萬輸入代幣 5 美元、每百萬輸出代幣 25 美元。Anthropic 表示,運算力度切換功能已立即開放給所有 API 使用者及 Claude Max 訂閱者。

Opus 5 是 Anthropic 在六十天內推出的第四款模型。成本與效能邊際曲線移動的速度,如今為企業買家帶來了另一個難題:何時該停止評估,真正開始部署。

標籤: , , , , ,

討論

共有 0 則留言。