為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Anthropic: Claude Haiku 4.5

適用於輕量級代理、辦公任務及即時對話的快速 Claude 通道
比較模型
claude-haiku-4-5
可用Anthropic對話輸入快取節省 90%
輸入 / 輸出-70%
$1.00 / $5.00$0.30 / $1.50
上下文
200K
最大輸出長度
64K
模態
視覺辨識對話
能力
工具使用提示詞快取推理

關於 Claude Haiku 4.5

Claude Haiku 4.5 是 Anthropic 於 2025 年 10 月推出的小型、快速 Claude 模型,適用於高流量與延遲敏感的工作。Anthropic 將其描述為產品陣容中速度最快且具備近乎前沿智慧的模型。它接受文字與圖像輸入,支援工具使用與提示詞快取(prompt caching),並使用帶有 Token 配額的手動擴展思考(extended thinking),而非較新 Claude 模型所使用的自適應思考。

適用場景

  • 在 Anthropic 概覽頁面列出的 Claude 模型中延遲最低,適合聊天前端與即時助理。
  • 能同時讀取圖像與文字,因此可大量分類螢幕截圖、收據與圖表。
  • 擴展思考功能為選用,並透過明確的 Token 配額設定,讓您針對每次請求決定投入多少推理成本。
  • 支援工具使用、結構化 JSON 輸出與提示詞快取,能降低代理迴圈中重複系統提示詞的成本。

其他選擇建議

  • 其知識截止日期遠早於 Claude 5 世代,因此對近期程式庫與事件的了解較少。
  • 相較於 Opus 與 Sonnet 5.x 模型,其上下文視窗與輸出上限較小,限制了處理整個儲存庫或書籍長度任務的能力。
  • 對於長期的自主編碼任務或模糊的多步驟規劃,使用 Sonnet 或 Opus 模型失敗的機率較低。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-4-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

定價

Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。

預設規格

每 1M Token
Official 定價
輸入 $1.00 / 輸出 $5.00 / 快取讀取 $0.10 / 快取寫入 $1.25
TokenLab 價格
輸入 $0.30 / 輸出 $1.50 / 快取讀取 $0.03 / 快取寫入 $0.375
折扣
-70%
Prompt 快取價格

快取讀取

Official 定價
$0.10
TokenLab 價格
$0.03
折扣
-70%

快取寫入

Official 定價
$1.25
TokenLab 價格
$0.375
折扣
-70%
工具費用

僅在模型呼叫工具時,依使用次數計費。

網路搜尋

Official 定價
$0.01/次搜尋
TokenLab 價格
$0.003/次搜尋
折扣
-70%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
100.0%
近 7 日中位數延遲
916 msn=273
近 7 日 P95 延遲
16 sn=273
近 30 日請求數
100+
最後活動時間
15 分鐘前

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Claude Haiku 4.5,並準備好編輯或發送提示詞。

協助我使用 claude-haiku-4-5 透過 /v1/messages 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 視覺辨識
  • 即時聊天與支援

    將其部署在客戶端介面後方,在回覆速度比深度更重要的場景下使用,並透過工具呼叫進行訂單查詢,若問題複雜則轉接人工。

  • 分類與提取

    為工單貼標籤、從發票或螢幕截圖中提取欄位,並為每天執行數千次的下游管線回傳嚴格的 JSON 格式資料。

  • 子代理工作者

    在多代理架構中作為低成本工作者:由較大的模型進行規劃,並由多個 Haiku 呼叫並行執行搜尋、摘要或檢查檔案。

提示詞範例

將此支援郵件分類為帳單、錯誤、功能請求或其他,並回傳包含標籤與一句話理由的 JSON。

將此聊天記錄摘要為三個要點,並列出任何待辦事項及其負責人。

查看這張錯誤對話框的螢幕截圖,告訴我使用者應該更改哪個設定。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

Claude Haiku 4.5 最適合用於什麼場景?

快速、高流量的工作:聊天助理、分類、資料提取、摘要與代理工作者。Anthropic 將其定位為速度最快且具備近乎前沿智慧的 Claude 模型,因此當回應時間與吞吐量比深度推理更重要時,它是首選。

Claude Haiku 4.5 支援擴展思考嗎?

支援,但採取手動形式:您需啟用思考功能並設定 Token 配額。它不使用較新 Sonnet 與 Opus 模型所採用的自適應思考模式或努力程度參數,因此您需透過設定配額來控制推理深度。

Claude Haiku 4.5 可以處理圖像嗎?

可以。它能同時處理圖像與文字並以文字回答。這涵蓋了讀取螢幕截圖、圖表與掃描文件。它無法生成或編輯圖像,若需要圖片輸出,請使用圖像模型。

何時應該從 Haiku 4.5 升級到 Sonnet?

當 Haiku 在處理長提示詞時遺漏指令、在多工具代理執行中遺失步驟,或需要了解近期發布的資訊時,就應升級。Sonnet 5.5 是下一步的選擇,它保持了快速的特性,並具備更長的上下文視窗與更晚的知識截止日期。

Claude Haiku 4.5 的費用是多少?

在 TokenLab 上,Claude Haiku 4.5 價格為 輸入 $0.30 / 輸出 $1.50 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Claude Haiku 4.5 的上下文長度與輸出限制為何?

Claude Haiku 4.5 支援最高 200,000 tokens 的上下文,單次回應上限為 64,000 tokens。

Claude Haiku 4.5 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/messages 進行 Claude Haiku 4.5 的呼叫。下方的請求範例展示了對應的程式碼格式。

Claude Haiku 4.5 支援哪些操作?

Claude Haiku 4.5 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Claude Haiku 4.5

使用 Claude Haiku 4.5 的指南

來源

更新於 2026年10月2日

更多來自 Claude 4 的模型

相關模型