Anthropic 發布 Claude Haiku 5.5:引入 effort controls,定價大降 90% 對標 GPT-6 Luna
已查原文 · 5 項主張
多個報導來源提及此事;未必是彼此獨立的證據。
報導中關於 Anthropic 發布 Claude Haiku 5.5 的各項宣稱均獲證實。包括其專為高吞吐量設計、引入 effort controls 功能、降價 90% 並對標 GPT-6 Luna 的定價結構,以及模型在代理程式編寫領域擊敗對手的表現。此外,開發者發現新分詞器造成約 1.25 倍 token 隱藏成本,以及官方同步調降 Sonnet 5.5 快取成本、發放 API 額度等消息,皆有原文與測試報告佐證。
Anthropic 發布適用於高吞吐量任務的 Claude Haiku 5.5,首度引入 effort controls(努力控制),且已在 AWS、Google Cloud 與 Azure 上線。
官方證實加入了可調的 effort 設定,媒體報導也確認該模型專為高處理量任務設計,並已在三大雲端平台上線。
adjustable effort setting
查看原始出處
high-volume tasks
查看原始出處
available now on AWS, Google Cloud, and Azure.
查看原始出處
Haiku 5.5 較前代降價達 90%,在 10 萬 token 內的定價與 GPT-6 Luna 完全一致;但超過 10 萬 token 後價格會飆升 5 倍。
官方公告證實最高有 90% 降幅;實測文章也確認其基礎定價對標 GPT-6 Luna,以及超過 10 萬 token 後 5 倍漲價的設計。
priced 90% lower
查看原始出處
matches the price of GPT-6 Luna
查看原始出處
price increases 5x
查看原始出處
開發者實測指出,Haiku 5.5 的新分詞器使相同提示詞約消耗前代的 1.25 倍 token,帶來隱藏成本。
開發者 Simon Willison 測試指出,相較於前代,相同長度提示詞在 Haiku 5.5 會消耗約 1.25 倍的 token 數量。
1.25x as many tokens with Haiku 5.5
查看原始出處
效能評測顯示,Haiku 5.5 表現提升,並在代理程式編寫(agentic coding)等領域擊敗了 GPT-6 Luna。
媒體根據基準測試結果指出,Haiku 5.5 在代理程式編寫等評測類別中超越了 OpenAI 的 GPT-6 Luna 模型。
beats OpenAI's budget model GPT-6 Luna in areas like agentic coding
查看原始出處
背景
Claude 是由 Anthropic 開發的大型語言模型系列。此次主打的「effort」參數功能,可讓使用者控制模型回覆時所使用的 token 數量,藉此在回覆的詳盡程度與 token 效率之間取得平衡。
來源
- Simon Willisonsimonwillison.net
- The Decoderthe-decoder.com
- Hacker Newsanthropic.com
- Reddit r/singularityreddit.com
- en.wikipedia.org
- platform.claude.com