Anthropic: Claude Haiku 5.5
claude-haiku-5-5- 輸入 / 輸出-70%
- $0.10 / $0.50$0.03 / $0.15
- 上下文
- 1M
- 發布日期
- 2026年10月7日
- 最大輸出長度
- 128K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取推理
關於 Claude Haiku 5.5
Claude Haiku 5.5 是 Anthropic 於 2026 年 10 月 7 日發布的小型、快速 Claude 模型,適用於分類、提取、路由和子代理任務等高流量、對延遲敏感的工作。這是首款具備可調式運算努力(effort)的 Haiku 模型,因此單一模型既能快速回答簡單請求,也能針對較難的任務進行更長時間的思考。Anthropic 稱其為標準速度下最快的模型,知識截止日期為 2026 年 6 月。
適用場景
- Anthropic 稱其為標準速度下最快的模型,適合即時客戶支援和瀏覽器操作。
- 這是首款具備運算努力等級的 Haiku 模型,因此單一模型即可處理快速對話和較長的代理任務。
- 根據 Anthropic 的報告,該模型在 OSWorld 2.1、GDPval-AA 和 Terminal-Bench 4.0 等基準測試中,相較於 Haiku 4.5 有顯著提升。
- 根據 Anthropic 的說明,它支援文字和圖片輸入,並可在編碼工作中作為 Opus 5.5 或 Sonnet 5.5 的子代理運作。
- 自適應思考(adaptive thinking)功能預設為開啟,且運算努力設定可控制模型的思考深度。
其他選擇建議
- Anthropic 表示,對於複雜的代理編碼和開放式任務,Sonnet 5.5 和 Opus 5.5 仍然是更好的選擇。
- 安全分類器可能會以拒絕原因(refusal stop reason)拒絕請求,且網路安全防護機制仍會阻擋滲透測試。
- 不支援手動思考預算(manual thinking budgets);具備運算努力設定的自適應思考功能已取代了該機制。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Messages APIPOST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
定價
Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。
輸入 權杖 <= 100K
每 1M Token- Official 定價
- 輸入 $0.10 / 輸出 $0.50 / 快取讀取 $0.01 / 快取寫入 $0.125
- TokenLab 價格
- 輸入 $0.03 / 輸出 $0.15 / 快取讀取 $0.003 / 快取寫入 $0.0375
- 折扣
- -70%
輸入 權杖 100K-1M
每 1M Token- Official 定價
- 輸入 $0.50 / 輸出 $2.50 / 快取讀取 $0.05 / 快取寫入 $0.625
- TokenLab 價格
- 輸入 $0.15 / 輸出 $0.75 / 快取讀取 $0.015 / 快取寫入 $0.1875
- 折扣
- -70%
快取讀取
- Official 定價
- $0.01
- TokenLab 價格
- $0.003
- 折扣
- -70%
快取寫入
- Official 定價
- $0.125
- TokenLab 價格
- $0.0375
- 折扣
- -70%
僅在模型呼叫工具時,依使用次數計費。
網路搜尋
- Official 定價
- $0.01/次搜尋
- TokenLab 價格
- $0.003/次搜尋
- 折扣
- -70%
| Official 定價每 1M Token | TokenLab 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 輸入 權杖 <= 100K | 輸入 $0.10 / 輸出 $0.50 / 快取讀取 $0.01 / 快取寫入 $0.125 | 輸入 $0.03 / 輸出 $0.15 / 快取讀取 $0.003 / 快取寫入 $0.0375 | -70% |
| 輸入 權杖 100K-1M | 輸入 $0.50 / 輸出 $2.50 / 快取讀取 $0.05 / 快取寫入 $0.625 | 輸入 $0.15 / 輸出 $0.75 / 快取讀取 $0.015 / 快取寫入 $0.1875 | -70% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.01 | $0.003 | -70% |
| 快取寫入 | $0.125 | $0.0375 | -70% |
| 工具費用僅在模型呼叫工具時,依使用次數計費。 | |||
| 網路搜尋 | $0.01/次搜尋 | $0.003/次搜尋 | -70% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Claude Haiku 5.5,並準備好編輯或發送提示詞。
協助我使用 claude-haiku-5-5 透過 /v1/messages 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
- 視覺辨識
高流量分類與路由
在大規模場景下標記工單、路由請求並從文件中提取欄位,這些場景最看重回應速度與穩定的吞吐量。
編碼工作流程中的子代理
執行如搜尋程式碼庫或摘要檔案等細分任務,同時由較大的模型主導工作,Anthropic 強調了這種搭配方式。
即時支援與瀏覽器任務
即時回答客戶問題或根據螢幕截圖執行瀏覽器操作,在這些場景中,輪次間的等待時間會影響體驗。
摘要與壓縮
將冗長的對話、文件或日誌濃縮為簡短摘要,並在步驟之間壓縮代理的上下文。
提示詞範例
將這 50 張支援工單分類為帳單、錯誤或功能請求,並回傳包含工單 ID 與類別的 JSON 列表。
閱讀此文件並將公司名稱、會計年度、營收與淨利提取至表格中。標記出任何你無法找到的數值。
將目前的對話摘要為六個要點,保留所有決策、待決問題與檔案名稱,以便新的代理能夠接續工作。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
Claude Haiku 5.5 最擅長什麼?
範圍狹窄、高流量的工作:分類、提取、路由、摘要、壓縮與子代理任務。Anthropic 將其行銷為最快的模型,並表示對於複雜的代理編碼,Sonnet 5.5 或 Opus 5.5 仍然表現更好。
在 Haiku 5.5 上我應該從哪個運算努力等級開始?
Anthropic 建議大多數工作(包括代理編碼)使用預設的「中(medium)」等級。對於對話、簡短工具任務與簡單的高流量請求,可使用「低(low)」等級,但在長代理提示詞中,它可能會跳過搜尋或提早停止。對於嚴格遵循指令的任務,請使用「高(high)」等級;僅在您自己的測試顯示有顯著提升時,才使用「xhigh」或「max」。
我可以關閉 Haiku 5.5 的思考功能嗎?
部分可以。思考功能是自適應的且預設開啟。在「低」、「中」、「高」運算努力等級下,發送「停用思考」指令有效;但在「xhigh」和「max」等級下會回傳錯誤。Anthropic 建議減少思考的首選方式是降低運算努力等級。思考過程會計入輸出限制,因此請預留空間。
Haiku 5.5 與 Haiku 4.5 有何不同?
Anthropic 報告指出其基準測試有顯著提升,具備更長的上下文視窗與輸出限制、可調式運算努力,並以自適應思考取代了手動思考預算。它使用了較新的分詞器(tokenizer),因此相同的文字會計算為更多的 Token,且其安全分類器能回傳 Haiku 4.5 所沒有的拒絕回應。
什麼時候應該選擇 Sonnet 5.5 而不是 Haiku 5.5?
對於複雜的代理編碼、長終端會話以及需要持續判斷力的任務,請選擇 Sonnet 5.5 或 Opus 5.5,Anthropic 表示它們在這些方面表現更強。當速度與流量至關重要,且任務範圍較窄(如分類、摘要或子代理工作)時,請選擇 Haiku 5.5。
Claude Haiku 5.5 的費用是多少?
在 TokenLab 上,Claude Haiku 5.5 價格為 輸入 $0.03 / 輸出 $0.15 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Claude Haiku 5.5 的上下文長度與輸出限制為何?
Claude Haiku 5.5 支援最高 1,000,000 tokens 的上下文,單次回應上限為 128,000 tokens。
Claude Haiku 5.5 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/messages 進行 Claude Haiku 5.5 的呼叫。下方的請求範例展示了對應的程式碼格式。
Claude Haiku 5.5 支援哪些操作?
Claude Haiku 5.5 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Claude Haiku 5.5
來源
- Introducing Claude Haiku 5.5
- Claude Haiku 5.5 model overview
- What's new in Claude Haiku 5.5
- Prompting Claude Haiku 5.5
更新於 2026年10月8日