Code & Chain · Signal Desk

Claude Opus 5 登场:Frontier-Bench 超越所有模型,效能为 Opus 4.8 两倍以上

原始來源Anthropic補充:TechCrunch補充:CNBC

摘要

Anthropic 于 7 月 24 日发布 Claude Opus 5,定价维持每百万输入 token 5 美元、输出 25 美元,与 Opus 4.8 相同。在 Frontier-Bench v0.1 上,Opus 5 超越所有现有模型,效能达 Opus 4.8 的两倍以上,且单一任务成本更低;在 CursorBench 3.2 以最高 effort 执行时,分数与 Fable 5 巅峰表现相差不到 0.5%,但每项任务成本仅约一半。ARC-AGI 3 的新问题解决能力得分为次佳模型的三倍。新增 effort 调节设定,可在智慧程度与 token 消耗之间取舍。Opus 5 成为 Cla…

重點整理

  • 使用 Claude Code、Codex 等代理工具的团队应重新评估预设模型与 effort 设定;资安高风险场景仍须留意 Opus 5 落后 Mythos 5。
  • 这是 Anthropic 两个月内第四款模型,接续 6 月初的 Fable 5 与 6 月底的 Sonnet 5。
  • 开发者可用相同预算取得接近前沿的模型能力,并透过 effort 设定按任务调整成本;Claude Max 用户预设即升级。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。