Claude Haiku 5.5 與 Sonnet 5.5 比較:各自適合哪些任務?
依任務、預設思考設定與工具行為比較 Claude Haiku 5.5 和 Sonnet 5.5,再針對實際工作負載建立小型評估。
以 Markdown 閱讀範圍明確的任務可先試 Claude Haiku 5.5;需要較持續的推理或複雜程式開發時,再比較 Sonnet 5.5。 這是依 Anthropic 推出時的指引提出的評估起點,不保證某個模型在所有範例都勝出。[1]
能說清楚什麼算正確回答,模型比較才有用。標註客服訊息、擷取交付日期與修復跨檔案錯誤,需要不同的檢查。請在 Haiku 5.5 線上體驗與 Sonnet 5.5 線上體驗中,使用相同來源資料與驗收標準。
哪些任務適合先試 Haiku 5.5?
Anthropic 將 Haiku 5.5 定位於高吞吐量、成本敏感的工作,例如摘要、分類、資料庫查詢,以及任務明確的程式開發子代理。範圍小且明確,更容易檢視結果與衡量工作負載。[1]
以客服分類器為例:定義標籤、加入模糊請求的範例,並決定應用程式如何處理不確定性。請將回傳標籤與審核過的資料集比較,不要只判斷解釋是否有說服力。擷取文件資訊時,須與來源比對必要欄位及其值。JSON 有效並不足以證明擷取正確。
Haiku 也可處理較大流程中的明確步驟:摘要一份文件、識別候選紀錄,或根據核准資料準備短篇草稿。提供該步驟所需的資訊與工具,在應用程式採取有重大影響的行動前,先檢視結果。
什麼時候應比較 Sonnet 5.5?
Anthropic 在 Haiku 公告中,仍建議複雜代理式程式開發使用 Sonnet 5.5 或 Opus 5.5。若任務須理解多個檔案、選擇做法並檢查變更後果,應將 Sonnet 納入比較。[1]
這不代表已證明兩者在你的程式碼儲存庫存在品質差距。讓兩個模型處理相同問題,提供相同可用工具與驗證步驟。記錄變更是否解決問題、通過相關檢查,且維持在要求範圍內,也記錄所需的修正或額外互動。
混合工作負載可能需要為不同任務選擇不同模型。可以評估較大模型處理開放式工作,再讓 Haiku 處理它產生的明確子任務,不必假定任一模型都應負責所有步驟。
請求設定有什麼不同?
兩個模型都有 100 萬 token 上下文視窗與標準 128,000 token 輸出上限,但思考與工具選擇契約不同。以下比較依據官方模型專屬文件,查核日期為 2026 年 10 月 9 日。[2][3]
| 設定 | Claude Haiku 5.5 | Claude Sonnet 5.5 |
|---|---|---|
| 模型 ID | claude-haiku-5-5 | claude-sonnet-5-5 |
| 預設投入程度 | medium | high |
| 預設思考 | 自適應 | 自適應 |
| 其他思考模式 | low、medium 或 high 投入程度下的 disabled | low、medium 或 high 投入程度下的 between_tools |
| 強制工具選擇 | 任意工具或指定名稱的工具 | 使用 auto 或 none |
手動 budget_tokens | 不支援 | 不支援 |
| 標準上下文/輸出上限 | 1M / 128K token | 1M / 128K token |
不要將 Sonnet 的思考模式複製到 Haiku 請求。同樣地,應用程式若要求呼叫特定工具,也須考量工具選擇規則差異。變更既有串接的模型 ID 前,請閱讀 Haiku API 參考與 Sonnet API 參考。
如何比較費用與投入程度?
先使用各模型文件所載的預設值,再測試應用程式需要的其他投入程度設定,並報告使用的設定。比較 medium 下的 Haiku 與 high 下的 Sonnet,衡量的是這兩組設定,不能單獨區分模型大小的影響。
本指南標籤所列模型的 SeedRouter 目前費率如下,表格依目前價格更新。
Claude Haiku 5.5
Claude Haiku 5.5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-haiku-5-5 | $0.35 | $1.75 | $0.035 | $0.4375 | unavailable |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.00245. A request that fails is not charged.
Claude Sonnet 5.5
Claude Sonnet 5.5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-sonnet-5-5 | $1.4 | $7 | $0.14 | $1.75 | $2.8 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.0098. A request that fails is not charged.
比較每個合格結果的總用量。納入輸入、輸出與快取類別,第一個回答無法使用時也須計入後續嘗試。token 費率較低,本身不代表完成整個工作流程比較便宜。Haiku 5.5 價格指南說明快取與 Anthropic 獨立的 100K 提示詞閾值。
小型評估應包含什麼?
從打算執行的工作負載挑選範例,包括一般輸入、模糊案例,以及正確行為應是說明資料不足的情況。提示詞修訂時保留獨立的測試集,避免將對範例的調整誤認為普遍可靠性。
| 任務 | 檢查結果 | 同時記錄 |
|---|---|---|
| 分類 | 標籤正確、模糊案例處理 | 投入程度、用量、無效標籤 |
| 擷取資訊 | 必要欄位、來源支持的值 | 剖析失敗、缺漏值、重試 |
| 摘要 | 保留重要事實、不杜撰內容 | 遺漏、來源長度、用量 |
| 程式開發 | 要求的行為與相關檢查 | 額外變更、修復嘗試、工具呼叫 |
這是評估計畫,並非已發表的效能基準。本指南不宣稱任一模型有實測速度或準確率優勢。提示詞或應用程式發生重要變更後,請重新比較,並將請求設定與結果一起保存。
Haiku 與 Sonnet 常見問題
完成一項任務時,Claude Haiku 5.5 一定比較便宜嗎?
請比較目前費率與實際用量,也包含額外嘗試。需要修正的任務,可能比第一個回應顯示的費用更高。
Haiku 5.5 可以強制呼叫指定名稱的工具嗎?
可以。官方契約接受指定名稱或任意工具選擇。指定的工具須已宣告,強制工具不能搭配零輸出快取預熱或隨選壓縮。[2]
兩個模型都能關閉思考嗎?
Haiku 在 low、medium 或 high 投入程度下接受 disabled 思考。Sonnet 在這些投入程度使用不同的 between_tools 模式,名稱不可互換。[2][3]
應將所有 Sonnet 任務遷移至 Haiku 嗎?
請分別評估每項任務。Anthropic 的指引支持在明確工作中嘗試 Haiku,同時在複雜程式開發的比較中保留較大模型。哪些任務適合遷移,應由自己的驗收檢查決定。[1]



