FB 建議貼文

選取貼文複製成功(包含文章連結)!

Claude Opus 5 登場:性能直逼頂規 Fable 5,主打高性價比與強大代理能力

Claude Opus 5 登場:性能直逼頂規 Fable 5,主打高性價比與強大代理能力

Anthropic 正式發表最新一代旗艦 AI 模型 Claude Opus 5。官方指出,該模型在程式碼編寫與知識工作評測上創下全新的業界標竿,其智慧水準直逼頂級的 Claude Fable 5,但成本僅有後者的一半,企圖在高效能與親民價格間取得全新平衡。

Claude Opus 5 登場:性能直逼頂規 Fable 5,主打高性價比與強大代理能力

效能全面升級:程式碼編寫與問題解決能力亮眼

根據 Anthropic 公布的評測數據,Claude Opus 5 在多項前沿基準測試中表現優異:

  • 程式與工程:在 Frontier-Bench 評測中,Opus 5 的表現超越所有現有模型,且成本更低;在 CursorBench 上的表現更在最高效能設定下,僅落後 Fable 5 不到 0.5%。
  • 高難度邏輯與自動化:在解決新穎問題的 ARC-AGI 3 測驗中,其得分是次佳模型的整整三倍;而在衡量商業任務自動化能力的 Zapier AutomationBench 上,其成功率達到次佳模型的 1.5 倍。
  • 科學研究:在生命科學領域(包含結構生物學、有機化學與生物資訊學)的各項評測中,Opus 5 的表現皆全面超越前一代的 Opus 4.8。

Claude Opus 5 登場:性能直逼頂規 Fable 5,主打高性價比與強大代理能力

強化主動性與自我修正機制

Anthropic 表示,Claude Opus 5 不僅反應更快、更具效率,更具備高度的主動性與 thoroughness(周密性)。早期測試顯示,該模型在面對複雜的除錯、程式碼重構以及長時間執行的自動化任務時,能夠更精準地自我檢查、驗證並修正錯誤,大幅降低了人工介入與重複除錯的需求。

此外,在安全性與對齊(Alignment)方面,經過自動化行為審計顯示,Opus 5 是 Anthropic 迄今為止對齊表現最佳的模型,具備最低的欺騙行為率,且在處理網路安全與生物學相關任務時,設定了更完善的防護網與自動備援機制。

上市資訊與定價

Claude Opus 5 即日起全面登陸各大平台,成為 Claude Pro 最強大的核心模型,並出任 Claude Max 的全新預設模型。

在 API 定價方面,維持與前一代 Opus 4.8 相同水準,輸入端為每百萬個 Token 5 美元,輸出端則為每百萬個 Token 25 美元。同時,官方也同步推出以兩倍價格運行的「快速模式(Fast Mode)」,滿足開發者對速度的極致追求。

ycr
作者

PC home 雜誌、T 客邦編輯,也負責 T 客邦影新聞 YouTube 頻道影音製作。關注 AI 相關應用、產業趨勢等消息,並有軟體教學報導。(大頭貼為 AI 生成)

發表回應
謹慎發言,尊重彼此。按此展開留言規則