為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Anthropic: Claude Haiku 5.5

Claude 最快速的模型,專為高吞吐量、對延遲敏感的工作而設計,例如分類、提取、路由和子代理任務。
比較模型
claude-haiku-5-5
可用Anthropic對話輸入快取節省 90%新發佈
輸入 / 輸出-70%
$0.10 / $0.50$0.03 / $0.15
上下文
1M
發布日期
2026年10月7日
最大輸出長度
128K
模態
視覺辨識對話
能力
工具使用提示詞快取推理

關於 Claude Haiku 5.5

Claude Haiku 5.5 是 Anthropic 於 2026 年 10 月 7 日發布的小型、快速 Claude 模型,適用於分類、提取、路由和子代理任務等高流量、對延遲敏感的工作。這是首款具備可調式運算努力(effort)的 Haiku 模型,因此單一模型既能快速回答簡單請求,也能針對較難的任務進行更長時間的思考。Anthropic 稱其為標準速度下最快的模型,知識截止日期為 2026 年 6 月。

適用場景

  • Anthropic 稱其為標準速度下最快的模型,適合即時客戶支援和瀏覽器操作。
  • 這是首款具備運算努力等級的 Haiku 模型,因此單一模型即可處理快速對話和較長的代理任務。
  • 根據 Anthropic 的報告,該模型在 OSWorld 2.1、GDPval-AA 和 Terminal-Bench 4.0 等基準測試中,相較於 Haiku 4.5 有顯著提升。
  • 根據 Anthropic 的說明,它支援文字和圖片輸入,並可在編碼工作中作為 Opus 5.5 或 Sonnet 5.5 的子代理運作。
  • 自適應思考(adaptive thinking)功能預設為開啟,且運算努力設定可控制模型的思考深度。

其他選擇建議

  • Anthropic 表示,對於複雜的代理編碼和開放式任務,Sonnet 5.5 和 Opus 5.5 仍然是更好的選擇。
  • 安全分類器可能會以拒絕原因(refusal stop reason)拒絕請求,且網路安全防護機制仍會阻擋滲透測試。
  • 不支援手動思考預算(manual thinking budgets);具備運算努力設定的自適應思考功能已取代了該機制。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Messages API
    POST/v1/messages
    API 格式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-5-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

定價

Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。

輸入 權杖 <= 100K

每 1M Token
Official 定價
輸入 $0.10 / 輸出 $0.50 / 快取讀取 $0.01 / 快取寫入 $0.125
TokenLab 價格
輸入 $0.03 / 輸出 $0.15 / 快取讀取 $0.003 / 快取寫入 $0.0375
折扣
-70%

輸入 權杖 100K-1M

每 1M Token
Official 定價
輸入 $0.50 / 輸出 $2.50 / 快取讀取 $0.05 / 快取寫入 $0.625
TokenLab 價格
輸入 $0.15 / 輸出 $0.75 / 快取讀取 $0.015 / 快取寫入 $0.1875
折扣
-70%
Prompt 快取價格

快取讀取

Official 定價
$0.01
TokenLab 價格
$0.003
折扣
-70%

快取寫入

Official 定價
$0.125
TokenLab 價格
$0.0375
折扣
-70%
工具費用

僅在模型呼叫工具時,依使用次數計費。

網路搜尋

Official 定價
$0.01/次搜尋
TokenLab 價格
$0.003/次搜尋
折扣
-70%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Claude Haiku 5.5,並準備好編輯或發送提示詞。

協助我使用 claude-haiku-5-5 透過 /v1/messages 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 視覺辨識
  • 高流量分類與路由

    在大規模場景下標記工單、路由請求並從文件中提取欄位,這些場景最看重回應速度與穩定的吞吐量。

  • 編碼工作流程中的子代理

    執行如搜尋程式碼庫或摘要檔案等細分任務,同時由較大的模型主導工作,Anthropic 強調了這種搭配方式。

  • 即時支援與瀏覽器任務

    即時回答客戶問題或根據螢幕截圖執行瀏覽器操作,在這些場景中,輪次間的等待時間會影響體驗。

  • 摘要與壓縮

    將冗長的對話、文件或日誌濃縮為簡短摘要,並在步驟之間壓縮代理的上下文。

提示詞範例

將這 50 張支援工單分類為帳單、錯誤或功能請求,並回傳包含工單 ID 與類別的 JSON 列表。

閱讀此文件並將公司名稱、會計年度、營收與淨利提取至表格中。標記出任何你無法找到的數值。

將目前的對話摘要為六個要點,保留所有決策、待決問題與檔案名稱,以便新的代理能夠接續工作。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

Claude Haiku 5.5 最擅長什麼?

範圍狹窄、高流量的工作:分類、提取、路由、摘要、壓縮與子代理任務。Anthropic 將其行銷為最快的模型,並表示對於複雜的代理編碼,Sonnet 5.5 或 Opus 5.5 仍然表現更好。

在 Haiku 5.5 上我應該從哪個運算努力等級開始?

Anthropic 建議大多數工作(包括代理編碼)使用預設的「中(medium)」等級。對於對話、簡短工具任務與簡單的高流量請求,可使用「低(low)」等級,但在長代理提示詞中,它可能會跳過搜尋或提早停止。對於嚴格遵循指令的任務,請使用「高(high)」等級;僅在您自己的測試顯示有顯著提升時,才使用「xhigh」或「max」。

我可以關閉 Haiku 5.5 的思考功能嗎?

部分可以。思考功能是自適應的且預設開啟。在「低」、「中」、「高」運算努力等級下,發送「停用思考」指令有效;但在「xhigh」和「max」等級下會回傳錯誤。Anthropic 建議減少思考的首選方式是降低運算努力等級。思考過程會計入輸出限制,因此請預留空間。

Haiku 5.5 與 Haiku 4.5 有何不同?

Anthropic 報告指出其基準測試有顯著提升,具備更長的上下文視窗與輸出限制、可調式運算努力,並以自適應思考取代了手動思考預算。它使用了較新的分詞器(tokenizer),因此相同的文字會計算為更多的 Token,且其安全分類器能回傳 Haiku 4.5 所沒有的拒絕回應。

什麼時候應該選擇 Sonnet 5.5 而不是 Haiku 5.5?

對於複雜的代理編碼、長終端會話以及需要持續判斷力的任務,請選擇 Sonnet 5.5 或 Opus 5.5,Anthropic 表示它們在這些方面表現更強。當速度與流量至關重要,且任務範圍較窄(如分類、摘要或子代理工作)時,請選擇 Haiku 5.5。

Claude Haiku 5.5 的費用是多少?

在 TokenLab 上,Claude Haiku 5.5 價格為 輸入 $0.03 / 輸出 $0.15 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Claude Haiku 5.5 的上下文長度與輸出限制為何?

Claude Haiku 5.5 支援最高 1,000,000 tokens 的上下文,單次回應上限為 128,000 tokens。

Claude Haiku 5.5 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/messages 進行 Claude Haiku 5.5 的呼叫。下方的請求範例展示了對應的程式碼格式。

Claude Haiku 5.5 支援哪些操作?

Claude Haiku 5.5 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Claude Haiku 5.5

來源

更新於 2026年10月8日

更多來自 Claude 5 的模型

相關模型