Claude Opus 5 正式上線,關鍵基準與價格上全面壓過 Fable 5
為何重要
- Opus 5 的出現強化了 AI 模型從「聽指令」到「自主推理與驗證」的進化,對開發者而言具體地呈現了在少數關鍵任務上機型選擇的實質勝負。 - 價格持平但越級打怪的情況,意味著中高階 B2B 企業在蒐集資料、建置 Agent 或進行複雜工程任務時,Opus 5 提供了尚未被滿足的價效比與能力視窗。 - 系統提示詞大幅簡化反映了未來 AI 工具發展的關鍵:不再依賴過度的人為工程腳手架(Rules/Emp),而是將判斷力交還給模型,這將影響 Anthropic 的客戶維護門檻與潛在客戶轉換率。
Anthropic 發布 Claude Opus 5,聲稱在硬核程式設計與推理基準上越級打怪,價格卻維持平盤。新模型不僅在 Front and 版對手雙倍多的分數,更透過大幅簡化 Claude Code 的系統提示詞,在保留推理能力的同時降低了工程門檻。
- 模型價格維持 Opus 4.8 水準(輸入 5 美元 / 輸出 25 美元 / 百萬 tokens),僅為 Fable 5 的一半。
- Frontier-Bench 程式設計任務得分 43.3%,是上一代 Opus 4.8 (21.1%) 的兩倍,大幅領先 Fable 5 的 33.7%。
- ARC-AGI-3 分數達 30.2%,是 GPT-5.6 Sol 的近四倍;並在未使用外部工具的情況下拿下 IMO 2026 滿分。
- Anthropic 淘汰了 Claude Code 80% 的系統提示詞,從靠指令「教」模型改為模型自我判斷與呼叫。