Anthropic 於美國時間十月七日推出小型模型 Claude Haiku 5.5,定位為高流量、對成本敏感的工作,例如摘要、上下文壓縮、資料庫查詢、分類、即時客服及瀏覽器操作。官方指其平均運行成本較 Haiku 4.5 低約百分之七十五:十萬詞元以內的請求每百萬輸入詞元只收零點一美元、輸出零點五美元,較上代便宜九成;電腦操作基準 OSWorld 2.1 由百分之十五點七升至百分之七十二點四。
同日 Anthropic 把 Sonnet 5.5 的快取讀取價減半,稱多數代理工作成本因此再降約兩成;本週亦向 Max 及 Team 訂戶發放每月 API 額度。不過 Anthropic 官方支援地區名單至今仍未包括香港及澳門,本地企業採用前須先處理合規與接入渠道問題。
Anthropic/官方:推出 Claude Haiku 5.5——運行成本較 Haiku 4.5 平均低約七成五,OSWorld 電腦操作得分升至百分之七十二點四;Sonnet 5.5 快取讀取同步減半
Anthropic 在其官方網站發布〈Introducing Claude Haiku 5.5〉,模型代號為 claude-haiku-5-5,即日於 Claude Platform 及 Amazon Web Services、Google Cloud、Microsoft Azure 等平台提供。本文先經科技媒體 9to5Mac 的 RSS 發現,再逐項核對 Anthropic 官方發布頁的定價表、基準數據、客戶引述及腳註,並對照官方支援地區頁面;來源真實性已驗證。
以下整理三個重點:Haiku 5.5 的定價與「平均低七成五」的計算方法;它在基準測試中的實際位置,以及何時仍應改用 Sonnet 或 Opus;最後是香港企業在支援地區限制下應如何評估。
一、核心事件:Haiku 一年後大換代,價格結構重寫
Haiku 是 Anthropic 三級主力模型中最細、最便宜的一級,之上是 Sonnet 與 Opus。是次由 Haiku 4.5 直接跳到 5.5,亦是 Anthropic 近一個月內第三款 5.5 系列模型,此前已推出 Opus 5.5 及 Sonnet 5.5。
官方對 Haiku 5.5 的定位相當清晰:
- 高流量、重複性工作:摘要、上下文壓縮(compaction)、資料庫查詢、分類請求;
- 作為子代理:配合 Opus 5.5 或 Sonnet 5.5 處理編程工作中較窄的子任務;
- 講求速度的場景:即時客服、瀏覽器操作。官方稱這是其「至今最快」的模型(以各模型標準速度計,但仍不及 Opus 的 Fast Mode)。
技術細節:定價表(每百萬詞元,美元)
| 項目 | Haiku 5.5(十萬詞元以內/以上) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 輸入 | 0.10/0.50 | 1.00 | 2.00 |
| 輸出 | 0.50/2.50 | 5.00 | 10.00 |
| 快取寫入 | 0.125/0.625 | 1.25 | 2.50 |
| 快取讀取 | 0.01/0.05 | 0.10 | 0.10(新價) |
官方腳註解釋「平均低約七成五」的算法:十萬詞元以內的請求較 Haiku 4.5 便宜九成,超過十萬詞元則便宜五成;而 Haiku 4.5 過往約九成請求屬於前者。同時,Haiku 5.5 改用與 Sonnet 5.5、Opus 5.5 相近的新分詞器,完成同一工作會用多少許詞元,官方已把這一點計入平均數。換言之,長文件、大型程式庫等超過十萬詞元的請求,省幅會明顯較少。
二、技術原理深度解析:小模型為何突然「追上來」
1. 基準數據
官方公布的對比如下(Sonnet 5.5 僅作參考):
| 基準 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1(知識工作,Elo) | 1620 | 735 | 1437 | 1840 |
| OSWorld 2.1(電腦操作,離線子集) | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity's Last Exam(無工具) | 45.9% | 10.2% | — | 56.9% |
| Humanity's Last Exam(有工具) | 57.4% | 18.7% | — | 64.5% |
| Terminal-Bench 4.0(代理編程) | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 Main | 46.4% | — | 42.4% | 52.1%(Xhigh) |
| Chartography(視覺推理,無工具) | 46.4% | 6.4% | 29.1% | 61.6% |
最值得注意的是電腦操作:OSWorld 2.1 由 Haiku 4.5 的百分之十五點七躍升至百分之七十二點四,亦高於 OpenAI GPT-6 Luna 的百分之四十八點九。這解釋了為何官方同時在 Python 及 TypeScript SDK 加入電腦操作與瀏覽器操作的測試版支援,並點名 Haiku 5.5 特別適合這類工作。
2. 首款可調「思考力度」的 Haiku
Haiku 5.5 是首款提供可調 effort 設定的 Haiku 級模型,與其他 Claude 模型一樣分為 Low、Med、High、Xhigh、Max 等檔位。官方以「準確度對成本」圖表展示:同一模型可按工作需要偏向省錢或偏向智能。對企業而言,這意味可以在路由層按任務難度動態調檔,而不必為簡單任務支付大型模型的價錢。
3. 官方自己劃出的界線
Anthropic 明言,Sonnet 5.5 與 Opus 5.5 仍是複雜代理編程(例如 Terminal-Bench 4.0 這類多步命令列任務)的較佳選擇;Haiku 5.5 適合範圍較窄、以往用 Claude 會太貴而做不成的工作,例如壓縮、摘要與子代理。上表 Terminal-Bench 4.0 百分之三十九點二對百分之七十點六的差距,正是這條界線的數據基礎。
三、日常應用場景
1. 開發者與技術團隊
- 主從代理架構:由 Opus 5.5 或 Sonnet 5.5 擔任主代理規劃,把讀檔、檢索、摘要、格式轉換交給 Haiku 5.5 子代理。Cognition 表示,在 Devin Fusion 以 Opus 5.5 帶領、Haiku 5.5 作副手,FrontierCode 仍維持六十六點二的高分,同時降低成本與延遲。
- 長對話壓縮:代理工作流常因上下文過長而成本飆升,Haiku 5.5 可專責 compaction,再把精簡結果交回主模型。
- 快取策略重算:Sonnet 5.5 快取讀取由每百萬詞元零點二美元減至零點一美元,官方稱多數代理工作因而便宜約兩成;重度依賴提示快取的團隊,值得重新計算單次任務成本。
2. 企業與私隱敏感行業
官方列出的早期客戶回饋,大多落在「量大、單次簡單」的企業工作:
- Asana:在 AI Teammates 評測中,任務完成延遲減少逾三成,每個代理回合推理最多快二點五倍;
- HubSpot:在 CRM 模擬環境三次平均得分百分之九十二點八,為其小型模型測試中最高;
- AlphaSense:其「Ask in Document」功能每週約八百萬次呼叫,四百條查詢評測中 Haiku 5.5 得分零點八四,對 Haiku 4.5 的零點七六;
- Box:較 Haiku 4.5 高十一分,延遲約減半,計劃用於成本報告、財務摘要及每週例行審閱;
- Rogo:在金融研究流程中,由 Haiku 5.5 子代理到年報抽取分部收入數字,再交大模型製作簡報。
這些都是企業數據最密集的環節,因此也是私隱與數據駐留要求最嚴格的環節。
3. 一般用戶
Anthropic 本週向訂戶發放每月 API 額度:Max 5x 每月一百美元、Max 20x 每月二百美元,Team 訂戶最多五百美元並由團隊成員共用,可用於任何模型。對個人開發者與小團隊來說,這等於以訂閱附帶的額度試做自家代理或小工具。
4. 香港與亞洲市場視角
本文核對 Anthropic 官方支援地區頁面時,名單包括台灣、新加坡、日本等地,但不包括香港及澳門。本站早前亦報道過香港用戶經 VPN 使用 Claude 遭停用的情況。因此,香港企業若想用 Haiku 5.5 的低價做客服、文件摘要或內部知識助理,應先確認:
- 所用渠道(直接訂閱、API,或經雲端平台)是否符合供應商及平台的服務地區條款;
- 客戶資料、合約、病歷等敏感內容會否離開本地或公司可控環境;
- 一旦供應商政策收緊,業務流程有沒有可替換的模型與部署方案。
對金融、醫療、法律及政府相關機構而言,「平價雲端模型」與「數據自主」之間的取捨,往往比每百萬詞元便宜幾仙更關鍵。
四、專業評價與潛在考量
優勢
- 價格斷層式下調:十萬詞元以內的輸入與輸出價格均為上代的十分之一,令大批過去因成本而擱置的自動化項目重新變得可行;
- 電腦操作能力大躍進:OSWorld 2.1 達百分之七十二點四,配合 SDK 新增的電腦及瀏覽器操作測試版,小模型亦可承擔實際操作型代理;
- 可調思考力度,讓同一模型同時服務低成本與較高準確度的需求;
- 即日登陸三大雲平台,企業可沿用既有雲端合約與治理流程。
需要留意的地方
- 「平均低七成五」以 Haiku 4.5 的請求分佈計算;長上下文請求只便宜五成,加上新分詞器用詞元稍多,實際省幅要以自家流量實測;
- 複雜代理編程仍明顯落後 Sonnet 5.5,不宜把整個開發流程交給 Haiku;
- 網絡安全保障較 Haiku 4.5 更嚴,仍會阻擋滲透測試等較可能被攻擊者利用的技術;需要更廣用途的機構要另行申請官方的網絡安全核證計劃;
- 香港不在官方支援地區之內,合規與服務連續性風險須由企業自行評估。
結語
Haiku 5.5 的意義不在於刷新最高分,而在於把「夠用的智能」價格壓到上代的十分之一,令子代理、客服、文件摘要與電腦操作這類高頻工作,第一次可以大規模鋪開。配合 Sonnet 5.5 快取減價與訂戶 API 額度,Anthropic 明顯在搶佔企業代理架構中「量最大的那一層」。
對香港企業而言,下一步是把成本模型與合規邊界一併計清:低價雲端 API 適合非敏感、可替換的工作;涉及客戶資料或受監管數據的流程,則更適合放在數據不出境的私有部署之上。如需在香港建立數據自主的私有 AI,可參考 YSK Limited 的企業私有 LLM 全託管,年費 HK$88,000 起,由 Dataset 到 QLoRA/LoRA 微調再到私有 API,數據百分百不出境(https://ysk.hk/services/ai-automation);如需團隊把主從代理、客服自動化等流程落地,亦可參考遠端開發者外判方案,HK$2,000/月起(https://ysk.hk/services/outsourcing)。
參考來源
- Anthropic 官方:Introducing Claude Haiku 5.5(2026 年 10 月 7 日)— https://www.anthropic.com/claude-haiku-5-5
- Anthropic 官方:Claude Haiku 模型頁 — https://www.anthropic.com/claude/haiku
- Anthropic 官方:支援國家及地區 — https://www.anthropic.com/supported-countries
- 9to5Mac:Anthropic upgrades Claude with new Haiku 5.5 model(RSS 發現來源)— https://9to5mac.com/2026/10/07/anthropic-upgrades-claude-with-new-haiku-5-5-model-details-here/
- YSK News 相關報道:Claude Sonnet 5.5 推出 — https://ysk.hk/r/1158;Anthropic 擴大網絡安全核證計劃 — https://ysk.hk/r/1373;香港用戶 Claude 遭停用 — https://ysk.hk/r/1253