AI快訊

Opus 5 上線同時,Anthropic 也在為今年 IPO 鋪路

林紀旭 James Lin總編輯
發布 · 更新
根據 Inside 與 TechNews 報導,Anthropic 於 2026 年 7 月 24 日發布 Claude Opus 5,以與前代 Opus 4.8 相同的每百萬 token 輸入 5 美元、輸出 25 美元定價,提供接近 Claude Fable 5 的效能。

Opus 5 的核心定位是什麼?它如何在性能與成本間取得平衡?

根據 TechNews 報導,Anthropic 上週五正式釋出全新 AI 模型 Claude Opus 5,主打「以一半的價格,提供接近頂級模型 Claude Fable 5 的前沿智慧」(E1)。Inside 報導進一步指出,Anthropic 官方在公告中直言,Opus 5「接近」Fable 5 的能力,但對於最複雜的專案,公司仍建議使用 Fable 5(E11)。這使 Opus 5 在 Anthropic 產品線中被定位為介於旗艦與主力機型之間的中間層級。

Opus 5 的定價策略相比其他模型有何優勢?

根據 TechNews 公布的每百萬代幣定價,三款模型的輸入與輸出價格如下:

模型輸入(每百萬token)輸出(每百萬token)
Claude Fable 510 美元50 美元
Claude Opus 55 美元25 美元
OpenAI GPT-5.6 Sol5 美元30 美元

(資料來源:E2)

若換算成完成同一項任務的人工分析智力指數加權平均成本,排序則有所變化:

模型加權平均成本
Claude Fable 52.75 美元
Claude Opus 52.03 美元
OpenAI GPT-5.6 Sol1.04 美元
Kimi K30.95 美元

(資料來源:E3)

值得注意的是,Inside 報導指出,Opus 5 的定價「與前代 Opus 4.8 完全相同」,同樣是每百萬 token 輸入 5 美元、輸出 25 美元(E8、E9),也就是說 Anthropic 並未因效能提升而調漲價格。

Opus 5 在客觀評測中的性能表現如何?

TechNews 引述官方數據指出,Opus 5 在多項評測中的具體表現如下:

測試項目Opus 5 表現
Frontier-Bench v0.1(軟體工程)超越所有對手,效能是前代 Opus 4.8 的兩倍以上,單次任務成本更低
ARC-AGI 3(問題解決)面對未見過的新問題,得分是次佳模型的三倍
Zapier AutomationBench(商業自動化)端到端完成任務通過率,是同等成本下次佳模型的 1.5 倍
OSWorld 2.0(電腦操作)相同成本超越所有模型,甚至突破 Fable 5 的最佳成績

(資料來源:E4)

Inside 報導則補充了 CursorBench 3.2 的比較數據:在難度最高的 CursorBench 3.2 裡,Opus 5 與 Fable 5 相差僅 0.5%,成本卻只要一半;OSWorld 2.0 則以 Fable 5 三分之一的成本超越其表現(E9)。

不過在安全相關任務上,官方對 Opus 5 的定位有所切割。Inside 報導指出,Anthropic 將 Opus 5 稱為「最一致的 Opus 模型」,也是最難被誘導濫用的版本,但在網路安全任務上,Opus 5 仍落後於 Mythos 5,官方形容其「在漏洞發現上接近 Mythos 5,但在漏洞利用方面遠落其後」(E14)。

Opus 5 提供哪些靈活的使用配置選項?

根據 Inside 報導,Anthropic 為 Opus 5 加入運算強度切換功能(effort),使用者可依任務需求在低、中、高、最高(xhigh)四段強度間選擇,直接決定模型願意花多少推理成本回答一個問題(E10)。

此外,Opus 5 還提供「快速模式(fast mode)」作為另一層槓桿:價格是標準模式的兩倍,換取 2.5 倍的處理速度(E12)。這代表使用者可以在成本與速度之間依需求做出取捨。

Opus 5 在安全性與可靠性方面的設計如何?

TechNews 報導指出,在 OSS-Fuzz 開源漏洞測試中,Opus 5 的發現率高達 80%,與主攻資安的 Mythos 5(79.4%)旗鼓相當;但 Opus 5 將漏洞「武器化」的能力被嚴格限制,成功率僅 4/14,遠低於 Mythos 5 的 13/14(E6)。這與前述 E14 所描述的「漏洞發現接近、漏洞利用遠落後」的定位相互呼應。

在可靠性方面,Anthropic 這次在 API 上推出「自動備援(Auto-fallback)」功能:未來當用戶的請求被判定對 Opus 5 或 Fable 5 來說過於敏感而觸發安全分類器時,系統不會直接封鎖,而是自動將請求降級,以確保工作流不會中斷(E7)。

另一方面,工程師 Thariq Shihipar 指出,官方在最新版本中刪除高達 80% 的 Claude Code 系統提示詞(System Prompts),並建議開發者使用 claude doctor 指令來自動優化現有的提示詞(E5)。

Anthropic 在短期內密集發布多款模型的背景是什麼?

根據 Inside 報導,Opus 5 是 Anthropic 兩個月內發布的第四款模型,6 月已陸續推出 Mythos 5、Fable 5 與 Sonnet 5(E13)。同一篇報導也指出,Anthropic 於 2026 年 7 月 24 日發布 Opus 5,正式在 Claude.ai、Claude Code、Claude Cowork 與 API 全平台上線,並成為 Claude Max 訂閱方案的新預設模型(E8)。與此同時,Anthropic 也正在籌備今年的首次公開發行(IPO)(E13)。

這代表什麼

將前述證據並列可以看到幾個交叉點:Opus 5 的定價與前代 Opus 4.8 完全相同(E8),卻在 Frontier-Bench、ARC-AGI 3、OSWorld 2.0 等多項評測中大幅拉開與前代的差距,甚至以更低成本逼近旗艦機型 Fable 5 的表現(E4、E9);官方也承認 Opus 5「接近」而非「等同」Fable 5,複雜專案仍建議使用 Fable 5(E11)。這種「同價、更強、但非最強」的定位,出現在 Anthropic 兩個月內密集推出第四款模型、同時籌備 IPO 的時間點上(E13),而安全性設計上刪除大量系統提示詞(E5)與限制漏洞武器化能力(E6、E14)並行推出自動備援機制(E7),顯示公司在追求效能與成本效率的同時,也試圖在可靠性與安全邊界上做出明確切割。

📊 證據與數據

常見問題

Opus 5 的定價是否比前代 Opus 4.8 更貴?

根據 Inside 報導,Opus 5 的定價與前代 Opus 4.8 完全相同,每百萬 token 輸入 5 美元、輸出 25 美元(E8)。

Opus 5 適合處理最複雜的專案嗎?

根據 Inside 報導,Anthropic 官方表示 Opus 5「接近」Fable 5 的能力,但對於最複雜的專案,公司仍建議使用 Fable 5(E11)。

林紀旭 James Lin總編輯

相關文章