
本文重點:Claude Haiku 5.5 是 Anthropic 在 2026 年 10 月 7 日推出的最小模型,定位在摘要、分類、資料庫查詢這類量大又重複的工作。100,000 token 以內的請求比 Haiku 4.5 便宜 90%,平均成本約低 75%。
即日起,Claude 5.5 家族總算集合完畢。Anthropic 在 2026 年 9 月 22 日推出 Claude Opus 5.5,9 月 28 日推出 Claude Sonnet 5.5,10 月 7 日再發表最小的 Claude Haiku 5.5。這一款模型的賣點很直接,價格大幅下降、速度更快,能力還比 Haiku 4.5 高出一大截,專門處理大量又重複的工作。這次同步還有兩個消息:Sonnet 5.5 的快取讀取價格砍半,Claude Max 與 Team 訂閱者每月也會多一筆 API 額度,值得關注一下最新的變化。
Claude Haiku 5.5 是什麼?
Claude Haiku 5.5 是 Anthropic 旗下 Haiku 系列的最新版本,定位是高用量、重視成本的任務。官方列出的適用工作包括摘要、上下文壓縮(compaction)、資料庫查詢與分類,這些工作量大、規則明確,用大模型處理很容易變成一筆可觀的開銷,Haiku 為此而生。
它也很適合搭配 Opus 5.5 或 Sonnet 5.5,在寫程式的流程中擔任子代理,由大模型負責主要判斷,Haiku 5.5 負責查資料、整理內容這類小任務,混搭使用是一個節省成本的方法。官方表示這是 Anthropic 速度最快的模型,所以在客服即時回覆與瀏覽器操作這類在意等待時間的場景特別適合。要留意的是,這個「最快」是指各模型的標準速度,Opus 在快速模式(Fast Mode)下仍然比 Haiku 5.5 更快。
Haiku 5.5 也是第一款提供思考強度(effort)設定的 Haiku。使用者可以像其他 Claude 模型一樣,自己決定要偏重成本還是偏重智慧,實際測試後可選擇的強度有 Low、Medium、High、Extra 與 Max,Medium 為推薦選項。
官方也提醒,複雜的 AI Agent 寫程式任務仍然應該交給 Sonnet 5.5 或 Opus 5.5,因此它也無法取代更高階的模型。Haiku 5.5 強項是範圍較小、過去因為成本太高而不敢大量使用 AI 的工作,遇到這種情境時才應該交給 Haiku 5.5 處理。
Claude Haiku 5.5 跑分:和 Haiku 4.5、GPT-6 Luna、Sonnet 5.5 比較
官方公布的跑分中,Haiku 5.5 相較 Haiku 4.5 全面大幅進步,也在所有列出的項目領先 OpenAI 的 GPT-6 Luna。下圖是 Anthropic 提供的各項測試結果,Sonnet 5.5 僅供參考:

從圖表來看,進步最明顯的是電腦操作,OSWorld 2.1 從 Haiku 4.5 的 15.7% 拉高到 72.4%,和 Sonnet 5.5 只差 11.5 個百分點。知識工作的 GDPval-AA 從 735 Elo 升到 1620 Elo,也比 GPT-6 Luna 高出 183 Elo。
和 Sonnet 5.5 比較,Haiku 5.5 在各項目都較低,其中差距最大的是終端機寫程式(Agentic coding),Terminal-Bench 4.0 是 39.2% 對 70.6%。這也呼應官方的建議,複雜的寫程式任務仍然留給 Sonnet 與 Opus 兩款更進階的模型。
實際使用上,Anthropic 引用的企業早期測試也指向速度與成本的改善:Asana 的 Agent 任務延遲降低超過 30%,每個回合的推論速度最多快 2.5 倍;Box 的測試得分比 Haiku 4.5 高 11 分,延遲約為一半。官方提供的都是廠商自己的測試情境,建議用自己的真實工作量跑一輪再決定要不要切換。
Haiku 5.5 的安全防護與使用限制
Anthropic 表示,Haiku 5.5 在幾乎所有對齊(alignment)評估上都比 Haiku 4.5 大幅進步,出現不當行為的情況少很多,配合濫用請求的意願也更低。
防護機制方面,使用上有兩點要留意:
- 資安:比 Haiku 4.5 更嚴格,但比其他近期模型稍寬鬆。允許的防禦性任務範圍比 Sonnet 5.5 更廣,不過仍然會擋下滲透測試與其他較可能被攻擊者使用的技術。
- 生物:與 Sonnet 5、Sonnet 5.5 和 Opus 5 相同,允許研究性的生物問題,但會限制被判斷為可能造成傷害的請求。
需要更廣泛生物或資安工作的組織,可以申請 Life Sciences Verification Program 與 Cyber Verification Program。
Claude Haiku 5.5 API 價格多少?比 Haiku 4.5 便宜約 75%
Haiku 5.5 的價格依提示長度分成兩級,100,000 token 以內與超過 100,000 token。官方指出,Haiku 4.5 約 90% 的請求落在 100,000 token 以內,所以大多數情況可以看第一級的價格(左邊的數字)。
以每百萬 token 計價,與 Haiku 4.5 和 Sonnet 5.5 的對照如下:

100,000 token 以內的請求,Haiku 5.5 的價格比 Haiku 4.5 低 90%,超過的部分低 50%。再加上 Haiku 5.5 換了新的 tokenizer(分詞器,負責把文字切成 token 計費的工具),完成同樣的工作會多用一些 token,官方把這個差異也算進去後,平均成本約低 75%。
用一個簡單的情境感受一下差距。假設要摘要 1 萬份文件,每份約 5,000 token 輸入、500 token 輸出,總計輸入 5,000 萬 token、輸出 500 萬 token,以第一級價格估算(未計入 tokenizer 差異):
| 模型 | 估算費用 |
|---|---|
| Haiku 5.5 | 7.5 美元 |
| Haiku 4.5 | 75 美元 |
| Sonnet 5.5 | 150 美元 |
Haiku 5.5、Sonnet 5.5、Opus 5.5 怎麼選?
三款模型在分工上其實很清楚,Haiku 5.5 負責大量、範圍小的工作,Sonnet 5.5 負責日常與一般程式任務,Opus 5.5 負責更長時間的複雜工作,將常見情境與建議模型整理如下:
| 情境 | 建議選擇 |
|---|---|
| 大量文件摘要、分類、資料庫查詢 | Haiku 5.5 |
| 上下文壓縮、擔任子代理查資料 | Haiku 5.5 |
| 即時客服、瀏覽器操作 | Haiku 5.5 |
| 日常問答、寫作、整理資料 | Sonnet 5.5 |
| 修 bug、製作文件、簡報、試算表 | Sonnet 5.5 |
| 長時間、多步驟的 AI Agent 任務 | Opus 5.5 |
| 需要持續判斷與取捨的複雜專案 | Opus 5.5 |
如果你已經在用 Sonnet 或 Opus 跑 Agent,可以把其中的查資料、摘要、整理這類子任務改交給 Haiku 5.5,主要判斷維持由大模型負責,成本會明顯下降。同樣主打速度與成本平衡的 Google 模型,可以參考 Gemini 3.8 Flash。
同步更新:Sonnet 5.5 快取讀取降價、Max 與 Team 每月送 API 額度
Anthropic 在發表 Haiku 5.5 的同時,也調整了其他產品的價格與福利。
Sonnet 5.5 快取讀取價格砍半
從發表當天起,Sonnet 5.5 的快取讀取從每百萬 token 0.2 美元降到 0.1 美元。由於快取讀取在 Agent 任務中佔了很大比例,官方估計 Sonnet 5.5 在多數 Agent 工作上的成本約降低 20%。

Max 與 Team 訂閱者每月 API 額度
2026 年 10 月 7 日當週起,Anthropic 會陸續提供所有 Max 與 Team 訂閱者每月的 Claude Platform API 額度,用來實驗開發呼叫 API 的工具、App 與 Agent,可以用在任何模型上:
| 方案 | 每月 API 額度 |
|---|---|
| Max 5x | 100 美元 |
| Max 20x | 200 美元 |
| Team | 最高 500 美元(全團隊共用) |
詳細規則可以參考官方的說明中心文章。
如何使用 Claude Haiku 5.5?
Claude Haiku 5.5 的使用管道可以依身分分成三種:
| 使用者類型 | 主要管道 | 費用 |
|---|---|---|
| 一般使用者 | Claude.ai 網頁版、Claude App | 依 Claude 方案,開放狀況以帳號模型選單為準 |
| 開發人員 | Claude Platform API、Claude Code | 依用量計費 |
| 企業使用者 | Team/Enterprise 方案、Amazon Web Services、Google Cloud、Microsoft Azure | 依方案或用量計費 |
一般使用者
Haiku 5.5 這次的重點放在 API 與雲端平台,官方公告沒有特別說明 Claude.ai 與 Claude App 各方案的開放細節,實際能不能選用,以帳號的模型選單為準。如果打開 Claude 從模型選單看到「Haiku 5.5」代表已更新,也就可以使用這款最新的 AI 模型(如下圖)。

開發人員
要把模型接進自己的程式或服務,可以透過 Claude Platform API 呼叫,模型名稱為 claude-haiku-5-5。從 Haiku 4.5 升級的人,建議先看官方的遷移指南,因為新分詞器會讓同樣內容的 token 數略為增加,預算估算必須要一起調整。
企業使用者
企業除了使用 Claude 的 Team 或 Enterprise 方案,Haiku 5.5 也已經在 Amazon Web Services、Google Cloud 與 Microsoft Azure 上架,方便整合到既有的雲端環境。
總結
Claude Haiku 5.5 這次更新的重點,在於把小模型的平均成本壓到原本的四分之一左右,能力也比 Haiku 4.5 大幅提升。像摘要、分類、資料庫查詢、客服與瀏覽器操作這類量大的工作,以前可能因為成本不敢全面導入,現在值得重新評估。
我會把 Claude Haiku 5.5 定位成大模型身邊的助手,主要判斷交給 Sonnet 5.5 或 Opus 5.5,查資料與整理內容交給 Haiku 5.5。要留意的是複雜寫程式任務與較進階的資安工作並不適合它,如果你有既有的 Haiku 4.5 專案,也建議先看過遷移指南,再依實際工作量測試成本。
常見問題
Claude Haiku 5.5 要付費嗎?
透過 API 串接依實際用量計費,100,000 token 以內的提示輸入每百萬 token 0.10 美元、輸出 0.50 美元。Claude.ai 的開放方案請以帳號模型選單為準。
Claude Haiku 5.5 和 Haiku 4.5 差在哪裡?
Haiku 5.5 的跑分全面提高,速度更快,平均成本約低 75%,並且新增思考強度設定。它也換了新的 tokenizer,同樣工作會多用一些 token。
Claude Haiku 5.5 和 Sonnet 5.5 該選哪一個?
大量、範圍明確、重視成本與速度的工作適合 Haiku 5.5,例如摘要、分類、資料庫查詢與子代理。複雜的 AI Agent 寫程式任務,官方建議使用 Sonnet 5.5 或 Opus 5.5。
Max 與 Team 的每月 API 額度有多少?
Max 5x 每月 100 美元,Max 20x 每月 200 美元,Team 最高 500 美元並由全團隊共用,可用在任何模型上,本週起陸續開放。
不想錯過好用的免費資源嗎?
已有 3.5 萬位讀者訂閱,新文章直接寄到你的信箱。











