FB 建議貼文

選取貼文複製成功(包含文章連結)!

Anthropic 推出新一代 AI 模型 Claude Opus 5.5:效能大躍進、成本大砍 40%

Anthropic 推出新一代 AI 模型 Claude Opus 5.5:效能大躍進、成本大砍 40%

Anthropic 發表全新 Claude 5.5 家族的首款旗艦模型 Claude Opus 5.5。新一代 Claude Opus 5.5 模型在自動化程式碼編寫、知識工作與資訊安全性上皆有顯著成長,同時在典型工作負載下的運行成本比前代 Opus 5 減少 40%,且生成速度快上 30% 以上。

核心效能與基準表現

在多項針對真實世界專業任務的基準測試中,Claude Opus 5.5 展現出色的處理能力。代理式編寫方面,在 Terminal-Bench 4.0 測試中取得領先表現。早期測試者指出,它能在不到一天內完成 68 萬行的程式碼遷移,並在命令列介面與多步驟任務中減少約 40% 的呼叫次數與一半的 Token 用量。

在評估 44 種真實專業工作的 GDPval-AA v2.1 測試中則獲得 1846 Elo 的成績。多個金融與軟體團隊回饋,模型不僅能獨立完成複雜的財務建模與季報分析,還能主動發現並修正評估指令中的微小索引錯誤。

Anthropic 推出新一代 AI 模型 Claude Opus 5.5:效能大躍進、成本大砍 40%

結構性定價調整與速度優化

Anthropic 透過架構最佳化降低了服務所需的運算資源,快取讀取價格降至每百萬 Token 0.20 美元,比前代減少 60%。一般 Token 定價輸入 Token 為每百萬 4 美元,輸出 Token 為 20 美元。

官方同步調高了 Pro、Max、Team 及企業方案的 5 小時使用限制,並提供可在需要時自行重置或保留的額度機制,另提供速度最高提升 2.5 倍的 Fast 模式選項。

Anthropic 推出新一代 AI 模型 Claude Opus 5.5:效能大躍進、成本大砍 40%

自然流暢的溝通風格與協作體驗

針對過去使用者反應前代產出內容過於冗長的問題,Opus 5.5 也在溝通方式上做了調整。新版本會將最核心的資訊置於最前方,減少不必要的專業術語與冗言贅字。早期工程師形容其產出的註解與說明更貼近真人的寫作習慣,在長期對話與跨團隊協作中更容易檢查與維護。

安全防禦機制與後續展望

安全性方面,Opus 5.5 通過了全面性的自動化行為審計,在防範提示詞注入攻擊的表現上達到歷來最佳。針對生命科學與網路安全等敏感領域,Anthropic 也設立了專屬的驗證計畫(如生命科學驗證計畫),供通過審查的組織安全應用。

隨著 Opus 5.5 的登場,官方預告 Claude Sonnet 5.5 與 Claude Haiku 5.5 也將在未來幾週內陸續推出。

ycr
作者

T 客邦網站、PChome 雜誌編輯,同時負責 T 客邦影新聞 YouTube 頻道及 FB、IG 等社群平台短影音製作。專注於 AI 應用、產業趨勢與軟體教學等科技內容報導。(大頭貼為 AI 生成)

發表回應
謹慎發言,尊重彼此。按此展開留言規則