NVIDIA擴大Agent Toolkit,納入PhysicsNeMo與CUDA-X函式庫:多家業者模擬效能最高提升50倍
根據NVIDIA新聞稿,NVIDIA宣布擴大NVIDIA Agent Toolkit,新增PhysicsNeMo與CUDA-X函式庫;同步推出cuISS、cuDSS、cuEST三款新函式庫,並指出Cadence、Samsung等企業導入後多項模擬效能提升最高達20倍。
根據 TechNews 報導,Anthropic 上週五正式釋出全新 AI 模型 Claude Opus 5,主打「以一半的價格,提供接近頂級模型 Claude Fable 5 的前沿智慧」(E1)。Inside 報導進一步指出,Anthropic 官方在公告中直言,Opus 5「接近」Fable 5 的能力,但對於最複雜的專案,公司仍建議使用 Fable 5(E11)。這使 Opus 5 在 Anthropic 產品線中被定位為介於旗艦與主力機型之間的中間層級。
根據 TechNews 公布的每百萬代幣定價,三款模型的輸入與輸出價格如下:
| 模型 | 輸入(每百萬token) | 輸出(每百萬token) |
|---|---|---|
| Claude Fable 5 | 10 美元 | 50 美元 |
| Claude Opus 5 | 5 美元 | 25 美元 |
| OpenAI GPT-5.6 Sol | 5 美元 | 30 美元 |
(資料來源:E2)
若換算成完成同一項任務的人工分析智力指數加權平均成本,排序則有所變化:
| 模型 | 加權平均成本 |
|---|---|
| Claude Fable 5 | 2.75 美元 |
| Claude Opus 5 | 2.03 美元 |
| OpenAI GPT-5.6 Sol | 1.04 美元 |
| Kimi K3 | 0.95 美元 |
(資料來源:E3)
值得注意的是,Inside 報導指出,Opus 5 的定價「與前代 Opus 4.8 完全相同」,同樣是每百萬 token 輸入 5 美元、輸出 25 美元(E8、E9),也就是說 Anthropic 並未因效能提升而調漲價格。
TechNews 引述官方數據指出,Opus 5 在多項評測中的具體表現如下:
| 測試項目 | Opus 5 表現 |
|---|---|
| Frontier-Bench v0.1(軟體工程) | 超越所有對手,效能是前代 Opus 4.8 的兩倍以上,單次任務成本更低 |
| ARC-AGI 3(問題解決) | 面對未見過的新問題,得分是次佳模型的三倍 |
| Zapier AutomationBench(商業自動化) | 端到端完成任務通過率,是同等成本下次佳模型的 1.5 倍 |
| OSWorld 2.0(電腦操作) | 相同成本超越所有模型,甚至突破 Fable 5 的最佳成績 |
(資料來源:E4)
Inside 報導則補充了 CursorBench 3.2 的比較數據:在難度最高的 CursorBench 3.2 裡,Opus 5 與 Fable 5 相差僅 0.5%,成本卻只要一半;OSWorld 2.0 則以 Fable 5 三分之一的成本超越其表現(E9)。
不過在安全相關任務上,官方對 Opus 5 的定位有所切割。Inside 報導指出,Anthropic 將 Opus 5 稱為「最一致的 Opus 模型」,也是最難被誘導濫用的版本,但在網路安全任務上,Opus 5 仍落後於 Mythos 5,官方形容其「在漏洞發現上接近 Mythos 5,但在漏洞利用方面遠落其後」(E14)。
根據 Inside 報導,Anthropic 為 Opus 5 加入運算強度切換功能(effort),使用者可依任務需求在低、中、高、最高(xhigh)四段強度間選擇,直接決定模型願意花多少推理成本回答一個問題(E10)。
此外,Opus 5 還提供「快速模式(fast mode)」作為另一層槓桿:價格是標準模式的兩倍,換取 2.5 倍的處理速度(E12)。這代表使用者可以在成本與速度之間依需求做出取捨。
TechNews 報導指出,在 OSS-Fuzz 開源漏洞測試中,Opus 5 的發現率高達 80%,與主攻資安的 Mythos 5(79.4%)旗鼓相當;但 Opus 5 將漏洞「武器化」的能力被嚴格限制,成功率僅 4/14,遠低於 Mythos 5 的 13/14(E6)。這與前述 E14 所描述的「漏洞發現接近、漏洞利用遠落後」的定位相互呼應。
在可靠性方面,Anthropic 這次在 API 上推出「自動備援(Auto-fallback)」功能:未來當用戶的請求被判定對 Opus 5 或 Fable 5 來說過於敏感而觸發安全分類器時,系統不會直接封鎖,而是自動將請求降級,以確保工作流不會中斷(E7)。
另一方面,工程師 Thariq Shihipar 指出,官方在最新版本中刪除高達 80% 的 Claude Code 系統提示詞(System Prompts),並建議開發者使用 claude doctor 指令來自動優化現有的提示詞(E5)。
根據 Inside 報導,Opus 5 是 Anthropic 兩個月內發布的第四款模型,6 月已陸續推出 Mythos 5、Fable 5 與 Sonnet 5(E13)。同一篇報導也指出,Anthropic 於 2026 年 7 月 24 日發布 Opus 5,正式在 Claude.ai、Claude Code、Claude Cowork 與 API 全平台上線,並成為 Claude Max 訂閱方案的新預設模型(E8)。與此同時,Anthropic 也正在籌備今年的首次公開發行(IPO)(E13)。
將前述證據並列可以看到幾個交叉點:Opus 5 的定價與前代 Opus 4.8 完全相同(E8),卻在 Frontier-Bench、ARC-AGI 3、OSWorld 2.0 等多項評測中大幅拉開與前代的差距,甚至以更低成本逼近旗艦機型 Fable 5 的表現(E4、E9);官方也承認 Opus 5「接近」而非「等同」Fable 5,複雜專案仍建議使用 Fable 5(E11)。這種「同價、更強、但非最強」的定位,出現在 Anthropic 兩個月內密集推出第四款模型、同時籌備 IPO 的時間點上(E13),而安全性設計上刪除大量系統提示詞(E5)與限制漏洞武器化能力(E6、E14)並行推出自動備援機制(E7),顯示公司在追求效能與成本效率的同時,也試圖在可靠性與安全邊界上做出明確切割。
根據 Inside 報導,Opus 5 的定價與前代 Opus 4.8 完全相同,每百萬 token 輸入 5 美元、輸出 25 美元(E8)。
根據 Inside 報導,Anthropic 官方表示 Opus 5「接近」Fable 5 的能力,但對於最複雜的專案,公司仍建議使用 Fable 5(E11)。
根據NVIDIA新聞稿,NVIDIA宣布擴大NVIDIA Agent Toolkit,新增PhysicsNeMo與CUDA-X函式庫;同步推出cuISS、cuDSS、cuEST三款新函式庫,並指出Cadence、Samsung等企業導入後多項模擬效能提升最高達20倍。
根據NVIDIA官方部落格,NVIDIA正與Cadence、Synopsys合作優化Vera CPU的EDA工具,測試顯示Jasper與VCS性能最高提升1.5倍;Vera CPU採用88個Olympus核心,已用於其下一代CPU與GPU設計工作流程。
根據NVIDIA新聞稿,SK集團與NVIDIA宣布擴大戰略夥伴關係,總規模逾5000億美元;SK Telecom將建置最高2 GW的Vera Rubin DSX AI工廠,首座預計2027年上線;NVIDIA並與SK海力士(SK hynix)簽署長期協議,共同開發次世代HBM記憶體。