AI快訊

Anthropic 推出 Claude Opus 5:定價不變、程式碼與代理任務表現躍升

N
Nathan科技編輯 · 技術負責人
發布 · 更新
根據VentureBeat與TechCrunch報導,Anthropic於2026年7月24日推出Claude Opus 5,定價維持每百萬輸入5美元、輸出25美元,與前代Opus 4.8相同;其在Frontier-Bench v0.1測試得分43.3%,較Opus 4.8的18.7%提升逾一倍。

Claude Opus 5 的定價策略與發布時機如何?

根據 VentureBeat 報導,Anthropic 於週五發布 Claude Opus 5,即時開放於所有平台使用,定價為每百萬輸入 token 5 美元、每百萬輸出 token 25 美元,與前代 Opus 4.8 相同,未調漲(E1)。TechCrunch 報導則指出,這次發布距離 Opus 4.8 於 5 月 28 日上線僅兩個月(E11),顯示 Anthropic 在旗艦模型更新節奏上明顯加快。

Opus 5 在基準測試中的性能表現如何,與競品相比如何?

根據 VentureBeat 報導,Opus 5 在 Frontier-Bench v0.1(一項代理式終端程式碼基準測試)得分 43.3%,是 Opus 4.8 的 18.7% 的兩倍以上,也領先競品 Fable 5 的 33.7%,且 Anthropic 表示每項任務成本更低(E2)。

模型Frontier-Bench v0.1 得分
Claude Opus 543.3%
Claude Opus 4.818.7%
Fable 533.7%

不過 Anthropic 也坦承,Opus 5 在網路安全與生物研究任務上仍落後於競爭模型 Mythos 5,而在某項代理式程式碼基準測試上,一款 OpenAI 系列模型仍居領先(E3)。在 OSS-Fuzz 漏洞發現評測中,Opus 5 的發現率為 79.4%,與 Mythos 5 的 80% 相近,但在成功開發漏洞利用(exploit)方面僅在 4 項挑戰成功,遠低於 Mythos 5 的 13 項(E7)。

模型漏洞發現率成功利用漏洞數
Claude Opus 579.4%4
Mythos 580%13

Opus 5 在生成效率上相比前代模型有何改進?

根據 VentureBeat 報導,法律 AI 公司 Harvey 的應用研究主管 Niko Grupen 表示,Opus 5 在達到與 Opus 4.8「最大推理模式」相近表現的同時,平均生成的 token 數少了 26%(E4),意味著在維持效能水準的情況下降低了輸出成本。

Opus 5 在自動化工作流程與企業應用中的實際表現如何?

Zapier 執行長 Wade Foster 向 VentureBeat 表示,Opus 5 在該公司的 AutomationBench 排行榜上奪冠,且未比先前的 Claude 模型消耗更多 token,並完整跑完從頭到尾的客戶流失預防工作流程;他指出「先前的模型都沒有通過,Opus 5 達到 100% 通過率」(E5)。

另一方面,Anthropic 自身的自動化行為審計顯示,Opus 5 是該公司目前為止最為對齊(aligned)的模型,整體不對齊行為得分為 2.3,低於 Opus 4.8、Sonnet 5 與 Fable 5,且欺騙行為發生率最低,也最不容易被誘導做出濫用行為(E6)。

Opus 5 在安全性與合規性方面有何優勢?

TechCrunch 報導指出,Opus 5 和前代一樣,不受適用於 Fable 與 Mythos 的 30 天資料保留政策限制,該政策先前曾引發部分注重隱私用戶的擔憂(E12)。此外,Anthropic 推出名為 Automatic Fallbacks 的測試版功能,使用者可選擇加入,當提示觸發安全分類器時,系統會自動將請求路由至能力較弱的模型(E13)。Anthropic 並預期,Opus 5 的安全分類器觸發頻率將比 Fable 5 低 85%,反映出對能力較弱模型採取更嚴格審查的差異化處理方式(E14)。

Anthropic 在企業市場中的競爭位置與商業表現如何?

根據 VentureBeat 引述 Contrary Research 於 2026 年 2 月的分析,截至 2025 年底,Claude 在企業大型語言模型市場的使用量佔比約 40%,其中 Claude Code 單一產品的年化收入即已達約 10 億美元(E8)。同一報導引述 Reuters 消息指出,Anthropic 在今年 2 月最新一輪融資中估值約 3800 億美元(E9)。此外,VentureBeat 也提到,美國一名法官本週最終批准了 Anthropic 與書籍作者達成的 15 億美元版權和解案,終結了針對該公司早期訓練資料的訴訟章節(E10)。

項目數值
企業 LLM 市場使用量佔比(2025年底)約 40%
Claude Code 年化收入約 10 億美元
Anthropic 最新估值(2026年2月)約 3800 億美元
版權和解金額15 億美元

這代表什麼

將各項證據並列可見,Anthropic 選擇在定價不變的前提下(E1),於 Opus 4.8 發布後僅兩個月即推出 Opus 5(E11),而效能提升集中在程式碼代理任務(Frontier-Bench v0.1 得分翻倍,E2)與生成效率(token 減少 26%,E4)。然而在網路安全、生物研究與漏洞利用能力上,Opus 5 仍落後於 Mythos 5(E3、E7),顯示這次更新並非全面領先,而是聚焦於企業客戶最常用的程式碼與自動化場景(E5)。同時,Anthropic 在安全對齊(E6)與資料保留政策(E12)上維持既有優勢,並新增分類器降低觸發率的設計(E14),這些安全性訊號與其近期版權和解落幕(E10)、估值達 3800 億美元(E9)的商業背景相互呼應,共同構成這次發布的整體脈絡。

📊 證據與數據

常見問題

Claude Opus 5 的定價是否比前代 Opus 4.8 更貴?

根據 VentureBeat 報導,Opus 5 的定價為每百萬輸入 token 5 美元、每百萬輸出 token 25 美元,與 Opus 4.8 完全相同,並未調漲(E1)。

Opus 5 是否受 30 天資料保留政策限制?

根據 TechCrunch 報導,Opus 5 與前代相同,不受適用於 Fable 與 Mythos 的 30 天資料保留政策限制(E12)。

Opus 5 在所有基準測試上都領先競品嗎?

並非如此。根據 VentureBeat 報導,Anthropic 坦承 Opus 5 在網路安全與生物研究任務上仍落後於 Mythos 5,且在某項代理式程式碼基準上仍有 OpenAI 系列模型領先(E3);在 OSS-Fuzz 漏洞利用測試中,Opus 5 僅成功利用 4 項挑戰,遠低於 Mythos 5 的 13 項(E7)。

N
Nathan科技編輯 · 技術負責人

相關文章