跳到主要內容
2026-10-08 日報
模型發布

Anthropic 發布 Claude Haiku 5.5:引入 effort controls,定價大降 90% 對標 GPT-6 Luna

Techmeme綜合 3 家報導多家報導
已查原文 · 5 項主張

多個報導來源提及此事;未必是彼此獨立的證據。

報導中關於 Anthropic 發布 Claude Haiku 5.5 的各項宣稱均獲證實。包括其專為高吞吐量設計、引入 effort controls 功能、降價 90% 並對標 GPT-6 Luna 的定價結構,以及模型在代理程式編寫領域擊敗對手的表現。此外,開發者發現新分詞器造成約 1.25 倍 token 隱藏成本,以及官方同步調降 Sonnet 5.5 快取成本、發放 API 額度等消息,皆有原文與測試報告佐證。

Anthropic 發布適用於高吞吐量任務的 Claude Haiku 5.5,首度引入 effort controls(努力控制),且已在 AWS、Google Cloud 與 Azure 上線。

官方證實加入了可調的 effort 設定,媒體報導也確認該模型專為高處理量任務設計,並已在三大雲端平台上線。

adjustable effort setting

查看原始出處

high-volume tasks

查看原始出處

available now on AWS, Google Cloud, and Azure.

查看原始出處

Haiku 5.5 較前代降價達 90%,在 10 萬 token 內的定價與 GPT-6 Luna 完全一致;但超過 10 萬 token 後價格會飆升 5 倍。

官方公告證實最高有 90% 降幅;實測文章也確認其基礎定價對標 GPT-6 Luna,以及超過 10 萬 token 後 5 倍漲價的設計。

priced 90% lower

查看原始出處

matches the price of GPT-6 Luna

查看原始出處

price increases 5x

查看原始出處

開發者實測指出,Haiku 5.5 的新分詞器使相同提示詞約消耗前代的 1.25 倍 token,帶來隱藏成本。

開發者 Simon Willison 測試指出,相較於前代,相同長度提示詞在 Haiku 5.5 會消耗約 1.25 倍的 token 數量。

1.25x as many tokens with Haiku 5.5

查看原始出處

效能評測顯示,Haiku 5.5 表現提升,並在代理程式編寫(agentic coding)等領域擊敗了 GPT-6 Luna。

媒體根據基準測試結果指出,Haiku 5.5 在代理程式編寫等評測類別中超越了 OpenAI 的 GPT-6 Luna 模型。

beats OpenAI's budget model GPT-6 Luna in areas like agentic coding

查看原始出處

Anthropic 同步將 Sonnet 5.5 快取讀取成本降 50%,並為訂閱用戶推出每月 API 額度。

官方公告明確指出 Sonnet 5.5 的快取讀取價格下降 50%,並針對訂閱用戶發放每月的 API 點數額度。

Cache reads now cost 50% less

查看原始出處

new monthly API credit

查看原始出處
Anthropic 發布最新小模型 Claude Haiku 5.5,專為摘要與分類等高吞吐量、成本敏感型任務設計,並首次在 Haiku 系列引入 effort controls。新模型目前已在 AWS、Google Cloud 與 Azure 上線。 定價方面,Haiku 5.5 較前代 4.5 版本大幅調降 90%。在 10 萬 token 內,其定價與 OpenAI 的 GPT-6 Luna 完全一致,為每百萬 token 輸入 0.10 美元、輸出 0.50 美元。但當上下文超過 10 萬 token 時,Haiku 5.5 的價格將飆升 5 倍(輸入 0.50 美元 / 輸出 2.50 美元);相比之下,GPT-6 Luna 要到 27.2 萬 token 才會微幅漲價至 0.20/0.75 美元。 開發者 Simon Willison 實測指出,Haiku 5.5 採用了新的分詞器(tokenizer),相同長度的提示詞消耗的 token 數量約為前代的 1.25 倍,帶來部分隱藏成本。 在效能評測上,Haiku 5.5 展現顯著提升,並在代理程式編寫(agentic coding)等領域擊敗了 GPT-6 Luna。此外,Anthropic 也同步將 Sonnet 5.5 的快取讀取成本調降 50%,並為訂閱用戶推出每月 API 額度。
讀原始報導

背景

Claude 是由 Anthropic 開發的大型語言模型系列。此次主打的「effort」參數功能,可讓使用者控制模型回覆時所使用的 token 數量,藉此在回覆的詳盡程度與 token 效率之間取得平衡。

來源