Anthropic 正式發表最新一代旗艦 AI 模型 Claude Opus 5。官方指出,該模型在程式碼編寫與知識工作評測上創下全新的業界標竿,其智慧水準直逼頂級的 Claude Fable 5,但成本僅有後者的一半,企圖在高效能與親民價格間取得全新平衡。

效能全面升級:程式碼編寫與問題解決能力亮眼
根據 Anthropic 公布的評測數據,Claude Opus 5 在多項前沿基準測試中表現優異:
- 程式與工程:在 Frontier-Bench 評測中,Opus 5 的表現超越所有現有模型,且成本更低;在 CursorBench 上的表現更在最高效能設定下,僅落後 Fable 5 不到 0.5%。
- 高難度邏輯與自動化:在解決新穎問題的 ARC-AGI 3 測驗中,其得分是次佳模型的整整三倍;而在衡量商業任務自動化能力的 Zapier AutomationBench 上,其成功率達到次佳模型的 1.5 倍。
- 科學研究:在生命科學領域(包含結構生物學、有機化學與生物資訊學)的各項評測中,Opus 5 的表現皆全面超越前一代的 Opus 4.8。

強化主動性與自我修正機制
Anthropic 表示,Claude Opus 5 不僅反應更快、更具效率,更具備高度的主動性與 thoroughness(周密性)。早期測試顯示,該模型在面對複雜的除錯、程式碼重構以及長時間執行的自動化任務時,能夠更精準地自我檢查、驗證並修正錯誤,大幅降低了人工介入與重複除錯的需求。
此外,在安全性與對齊(Alignment)方面,經過自動化行為審計顯示,Opus 5 是 Anthropic 迄今為止對齊表現最佳的模型,具備最低的欺騙行為率,且在處理網路安全與生物學相關任務時,設定了更完善的防護網與自動備援機制。
上市資訊與定價
Claude Opus 5 即日起全面登陸各大平台,成為 Claude Pro 最強大的核心模型,並出任 Claude Max 的全新預設模型。
在 API 定價方面,維持與前一代 Opus 4.8 相同水準,輸入端為每百萬個 Token 5 美元,輸出端則為每百萬個 Token 25 美元。同時,官方也同步推出以兩倍價格運行的「快速模式(Fast Mode)」,滿足開發者對速度的極致追求。
請注意!留言要自負法律責任,相關案例層出不窮,請慎重發文!