Anthropic: Claude Haiku 4.5
claude-haiku-4-5- 輸入 / 輸出-70%
- $1.00 / $5.00$0.30 / $1.50
- 上下文
- 200K
- 最大輸出長度
- 64K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取推理
關於 Claude Haiku 4.5
Claude Haiku 4.5 是 Anthropic 於 2025 年 10 月推出的小型、快速 Claude 模型,適用於高流量與延遲敏感的工作。Anthropic 將其描述為產品陣容中速度最快且具備近乎前沿智慧的模型。它接受文字與圖像輸入,支援工具使用與提示詞快取(prompt caching),並使用帶有 Token 配額的手動擴展思考(extended thinking),而非較新 Claude 模型所使用的自適應思考。
適用場景
- 在 Anthropic 概覽頁面列出的 Claude 模型中延遲最低,適合聊天前端與即時助理。
- 能同時讀取圖像與文字,因此可大量分類螢幕截圖、收據與圖表。
- 擴展思考功能為選用,並透過明確的 Token 配額設定,讓您針對每次請求決定投入多少推理成本。
- 支援工具使用、結構化 JSON 輸出與提示詞快取,能降低代理迴圈中重複系統提示詞的成本。
其他選擇建議
- 其知識截止日期遠早於 Claude 5 世代,因此對近期程式庫與事件的了解較少。
- 相較於 Opus 與 Sonnet 5.x 模型,其上下文視窗與輸出上限較小,限制了處理整個儲存庫或書籍長度任務的能力。
- 對於長期的自主編碼任務或模糊的多步驟規劃,使用 Sonnet 或 Opus 模型失敗的機率較低。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Messages APIPOST/v1/messagesAPI 格式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-4-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
定價
Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。
預設規格
每 1M Token- Official 定價
- 輸入 $1.00 / 輸出 $5.00 / 快取讀取 $0.10 / 快取寫入 $1.25
- TokenLab 價格
- 輸入 $0.30 / 輸出 $1.50 / 快取讀取 $0.03 / 快取寫入 $0.375
- 折扣
- -70%
快取讀取
- Official 定價
- $0.10
- TokenLab 價格
- $0.03
- 折扣
- -70%
快取寫入
- Official 定價
- $1.25
- TokenLab 價格
- $0.375
- 折扣
- -70%
僅在模型呼叫工具時,依使用次數計費。
網路搜尋
- Official 定價
- $0.01/次搜尋
- TokenLab 價格
- $0.003/次搜尋
- 折扣
- -70%
| Official 定價每 1M Token | TokenLab 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $1.00 / 輸出 $5.00 / 快取讀取 $0.10 / 快取寫入 $1.25 | 輸入 $0.30 / 輸出 $1.50 / 快取讀取 $0.03 / 快取寫入 $0.375 | -70% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.10 | $0.03 | -70% |
| 快取寫入 | $1.25 | $0.375 | -70% |
| 工具費用僅在模型呼叫工具時,依使用次數計費。 | |||
| 網路搜尋 | $0.01/次搜尋 | $0.003/次搜尋 | -70% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
- 近 30 日成功率
- 100.0%
- 近 7 日中位數延遲
- 916 msn=273
- 近 7 日 P95 延遲
- 16 sn=273
- 近 30 日請求數
- 100+
- 最後活動時間
- 15 分鐘前
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Claude Haiku 4.5,並準備好編輯或發送提示詞。
協助我使用 claude-haiku-4-5 透過 /v1/messages 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
- 視覺辨識
即時聊天與支援
將其部署在客戶端介面後方,在回覆速度比深度更重要的場景下使用,並透過工具呼叫進行訂單查詢,若問題複雜則轉接人工。
分類與提取
為工單貼標籤、從發票或螢幕截圖中提取欄位,並為每天執行數千次的下游管線回傳嚴格的 JSON 格式資料。
子代理工作者
在多代理架構中作為低成本工作者:由較大的模型進行規劃,並由多個 Haiku 呼叫並行執行搜尋、摘要或檢查檔案。
提示詞範例
將此支援郵件分類為帳單、錯誤、功能請求或其他,並回傳包含標籤與一句話理由的 JSON。
將此聊天記錄摘要為三個要點,並列出任何待辦事項及其負責人。
查看這張錯誤對話框的螢幕截圖,告訴我使用者應該更改哪個設定。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
Claude Haiku 4.5 最適合用於什麼場景?
快速、高流量的工作:聊天助理、分類、資料提取、摘要與代理工作者。Anthropic 將其定位為速度最快且具備近乎前沿智慧的 Claude 模型,因此當回應時間與吞吐量比深度推理更重要時,它是首選。
Claude Haiku 4.5 支援擴展思考嗎?
支援,但採取手動形式:您需啟用思考功能並設定 Token 配額。它不使用較新 Sonnet 與 Opus 模型所採用的自適應思考模式或努力程度參數,因此您需透過設定配額來控制推理深度。
Claude Haiku 4.5 可以處理圖像嗎?
可以。它能同時處理圖像與文字並以文字回答。這涵蓋了讀取螢幕截圖、圖表與掃描文件。它無法生成或編輯圖像,若需要圖片輸出,請使用圖像模型。
何時應該從 Haiku 4.5 升級到 Sonnet?
當 Haiku 在處理長提示詞時遺漏指令、在多工具代理執行中遺失步驟,或需要了解近期發布的資訊時,就應升級。Sonnet 5.5 是下一步的選擇,它保持了快速的特性,並具備更長的上下文視窗與更晚的知識截止日期。
Claude Haiku 4.5 的費用是多少?
在 TokenLab 上,Claude Haiku 4.5 價格為 輸入 $0.30 / 輸出 $1.50 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Claude Haiku 4.5 的上下文長度與輸出限制為何?
Claude Haiku 4.5 支援最高 200,000 tokens 的上下文,單次回應上限為 64,000 tokens。
Claude Haiku 4.5 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/messages 進行 Claude Haiku 4.5 的呼叫。下方的請求範例展示了對應的程式碼格式。
Claude Haiku 4.5 支援哪些操作?
Claude Haiku 4.5 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Claude Haiku 4.5
使用 Claude Haiku 4.5 的指南
來源
更新於 2026年10月2日