Code & Chain · Signal Desk

Claude Opus 5 登場:Frontier-Bench 超越所有模型,效能為 Opus 4.8 兩倍以上

原始來源Anthropic補充:TechCrunch補充:CNBC

摘要

Anthropic 於 7 月 24 日發布 Claude Opus 5,定價維持每百萬輸入 token 5 美元、輸出 25 美元,與 Opus 4.8 相同。在 Frontier-Bench v0.1 上,Opus 5 超越所有現有模型,效能達 Opus 4.8 的兩倍以上,且單一任務成本更低;在 CursorBench 3.2 以最高 effort 執行時,分數與 Fable 5 巔峰表現相差不到 0.5%,但每項任務成本僅約一半。ARC-AGI 3 的新問題解決能力得分為次佳模型的三倍。新增 effort 調節設定,可在智慧程度與 token 消耗之間取捨。Opus 5 成為 Cla…

重點整理

  • 使用 Claude Code、Codex 等代理工具的團隊應重新評估預設模型與 effort 設定;資安高風險場景仍須留意 Opus 5 落後 Mythos 5。
  • 這是 Anthropic 兩個月內第四款模型,接續 6 月初的 Fable 5 與 6 月底的 Sonnet 5。
  • 開發者可用相同預算取得接近前沿的模型能力,並透過 effort 設定按任務調整成本;Claude Max 用戶預設即升級。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。