FB 建議貼文

選取貼文複製成功(包含文章連結)!

史上最快 Claude 模型登場!Haiku 5.5 定價下殺 90%,主打百萬上下文與高併發

史上最快 Claude 模型登場!Haiku 5.5 定價下殺 90%,主打百萬上下文與高併發

Anthropic 正式發表 Claude Haiku 5.5,這是 Claude 5.5 系列第三款模型,睽違近一年接續 Haiku 4.5,主打高併發、低延遲、成本敏感任務的輕量級新作。十萬 Token 以內輸入每百萬 0.10 美元、輸出 0.50 美元,較上代直降九成,已上架 Claude 平台、Amazon Web Services、Google Cloud 與 Microsoft Foundry。

史上最快 Claude 模型登場!Haiku 5.5 定價下殺 90%,主打百萬上下文與高併發

十萬 Token 門檻之後,價格一口氣跳到五倍

Haiku 5.5 的入場價相當殺:輸入 0.10 美元、輸出 0.50 美元,相對於 Haiku 4.5 的 1 美元與 5 美元,帳面下殺 90%。

但這張價目表只涵蓋十萬 Token 以內的請求。一旦越線,輸入與輸出立刻翻到 0.50 美元與 2.50 美元,等於門檻後一口氣乘以五。

短文本請求感受不到這個落差;長文件、多輪程式碼任務與大型 Agent 很容易逼近甚至超標,預算可能在不知不覺中翻車。

史上最快 Claude 模型登場!Haiku 5.5 定價下殺 90%,主打百萬上下文與高併發

新分詞器重算 Token,實際成本只降七成五

Haiku 5.5 換上與 Sonnet 5.5、Opus 5.5 同源的新分詞器。同樣一段文字,切出來的 Token 數變多。

Anthropic 自己承認,完成相同任務會產生略多 Token;實測下,同一份長文本在 Haiku 5.5 上比 Haiku 4.5 多消耗約 25% 至 30%。因此,雖然號稱價格下殺了九成、實際平均成本只降約 75% 。而且在單價考量之外,模型完成任務要燒多少 Token,也成了新的成本變數。

Haiku 5.5 最高支援一百萬 Token 上下文視窗,最大輸出 128K Token,並具備自適應思考,能依任務難度動態調度推理資源。它也是 Anthropic 目前回應最快的模型,定位是 Opus 5.5 與 Sonnet 5.5 的副手:負責摘要、資料分類、資訊提取、資料庫查詢、請求路由與上下文壓縮等重複性工作。

在 Agent 與程式碼應用的情境下,Haiku 5.5 適合擔任子代理,處理程式碼搜尋、簡易修改這類可拆解的雜活;複雜多步驟編程,仍由 Sonnet 5.5、Opus 5.5 主導。

為了助攻 Agent 工作負載,Anthropic 同步把 Sonnet 5.5 的快取讀取價格從每百萬 0.20 美元砍到 0.10 美元,降幅 50%,官方估可讓多數 Agent 實際成本再降約 20%。

對決面上,以十萬 Token 以內標準價計算,Haiku 5.5 已走進 OpenAI 最新低成本模型的同一區間,卻附帶百萬上下文視窗與自適應推理。

目前 Haiku 5.5 已進駐 Claude Code,一般使用者也能在 Claude 網頁、iOS 與 Android 版使用。產品線分工就此定調:Opus 5.5 攻最難的推理與 Agent,Sonnet 5.5 拿捏效能與成本,Haiku 5.5 下沉到高併發、低延遲的大用量場景。

隨著 Agent 從單次問答走向一次幾十、上百次連續呼叫,單次價格、回應速度與 Token 效率會直接決定整套系統的營運成本。不過企業或是工作者在導入前,應按真實工作負載試算總成本,而非只看每百萬 Token 的宣傳價。價格雖然應該會比之前便宜,但應該不會便宜到九成那麼多。

 

 

 

 

 

cnBeta
作者

cnBeta.COM(被網友簡稱為CB、cβ),官方自我定位「中文業界資訊站」,是一個提供IT相關新聞資訊、技術文章和評論的中文網站。其主要特色為遊客的匿名評論及線上互動,形成獨特的社群文化。

發表回應
謹慎發言,尊重彼此。按此展開留言規則