Anthropic: Claude Haiku 5.5
claude-haiku-5-5- 入力 / 出力-70%
- $0.10 / $0.50$0.03 / $0.15
- コンテキスト
- 1M
- リリース日
- 2026年10月7日
- 最大出力
- 128K
- モダリティ
- ビジョンチャット
- 機能
- ツール利用プロンプトキャッシュ推論
Claude Haiku 5.5 について
Claude Haiku 5.5は、2026年10月7日にリリースされたAnthropicの小型で高速なClaudeモデルです。分類、抽出、ルーティング、サブエージェントタスクといった、大量かつ低遅延が求められる作業に適しています。Haikuとして初めて努力レベル(effort)の調整が可能になり、単一のモデルで単純なリクエストには素早く回答し、難しいリクエストには時間をかけて思考することができます。Anthropicは、標準速度において同社最速のモデルであるとしており、知識のカットオフは2026年6月です。
得意なこと
- Anthropicは、標準速度において同社最速のモデルであるとしており、ライブカスタマーサポートやブラウザ操作に適しています。
- Haikuとして初めて努力レベルに対応しており、単一のモデルで迅速なチャット対応から長時間のエージェントタスクまでをこなすことができます。
- Anthropicは、OSWorld 2.1、GDPval-AA、Terminal-Bench 4.0などのベンチマークにおいて、Haiku 4.5から大幅な性能向上を報告しています。
- Anthropicによると、テキストと画像の入力に対応しており、コーディング作業においてOpus 5.5やSonnet 5.5のサブエージェントとして機能します。
- 適応型思考(Adaptive thinking)はデフォルトで有効になっており、努力設定によってモデルの思考量を制御できます。
他のモデルを検討すべきケース
- Anthropicは、複雑なエージェントによるコーディングやオープンエンドな作業には、引き続きSonnet 5.5やOpus 5.5の方が適しているとしています。
- 安全分類器(Safety classifiers)は拒否の停止理由とともにリクエストを拒否することがあり、サイバーセキュリティのセーフガードは引き続きペネトレーションテストをブロックします。
- 手動の思考予算(Manual thinking budgets)はサポートされていません。代わりに、努力設定を伴う適応型思考が採用されています。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストMessages APIPOST/v1/messagesAPI形式:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
料金
VerifiedはTokenLab価格で低コストに、Officialは提供元の価格で高い信頼性を提供します。Autoはリクエストを完了したルートの料金を適用します。
入力 トークン <= 100K
100万トークンあたり- 公式価格
- 入力 $0.10 / 出力 $0.50 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125
- TokenLab 価格
- 入力 $0.03 / 出力 $0.15 / キャッシュ読み取り $0.003 / キャッシュ書き込み $0.0375
- 割引
- -70%
入力 トークン 100K-1M
100万トークンあたり- 公式価格
- 入力 $0.50 / 出力 $2.50 / キャッシュ読み取り $0.05 / キャッシュ書き込み $0.625
- TokenLab 価格
- 入力 $0.15 / 出力 $0.75 / キャッシュ読み取り $0.015 / キャッシュ書き込み $0.1875
- 割引
- -70%
キャッシュ読み取り
- 公式価格
- $0.01
- TokenLab 価格
- $0.003
- 割引
- -70%
キャッシュ書き込み
- 公式価格
- $0.125
- TokenLab 価格
- $0.0375
- 割引
- -70%
ツール利用時のみ、呼び出しごとに料金が発生します。
ウェブ検索
- 公式価格
- $0.01/検索
- TokenLab 価格
- $0.003/検索
- 割引
- -70%
| 公式価格100万トークンあたり | TokenLab 価格100万トークンあたり | 割引 | |
|---|---|---|---|
| 入力 トークン <= 100K | 入力 $0.10 / 出力 $0.50 / キャッシュ読み取り $0.01 / キャッシュ書き込み $0.125 | 入力 $0.03 / 出力 $0.15 / キャッシュ読み取り $0.003 / キャッシュ書き込み $0.0375 | -70% |
| 入力 トークン 100K-1M | 入力 $0.50 / 出力 $2.50 / キャッシュ読み取り $0.05 / キャッシュ書き込み $0.625 | 入力 $0.15 / 出力 $0.75 / キャッシュ読み取り $0.015 / キャッシュ書き込み $0.1875 | -70% |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.01 | $0.003 | -70% |
| キャッシュ書き込み | $0.125 | $0.0375 | -70% |
| ツール利用料ツール利用時のみ、呼び出しごとに料金が発生します。 | |||
| ウェブ検索 | $0.01/検索 | $0.003/検索 | -70% |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでClaude Haiku 5.5を開き、プロンプトを編集・送信できます。
claude-haiku-5-5と/v1/messagesでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
向いている用途- 推論
- ビジョン
大量の分類およびルーティング
チケットのラベル付け、リクエストのルーティング、文書からのフィールド抽出など、応答速度と安定したスループットが最も重要となる大量処理に適しています。
コーディングワークフローにおけるサブエージェント
Anthropicが推奨する活用法として、より大規模なモデルが作業を主導する中で、コードベースの検索やファイルの要約といった限定的なサイドタスクを実行します。
ライブサポートおよびブラウザタスク
ターン間の待ち時間が体験を左右する、リアルタイムでの顧客対応やスクリーンショットに基づくブラウザ操作に適しています。
要約および圧縮
長い会話、報告書、ログを短い要約にまとめたり、ステップ間でエージェントのコンテキストを圧縮したりします。
プロンプト例
これら50件のサポートチケットを「請求」「バグ」「機能リクエスト」に分類し、チケットIDとカテゴリを含むJSONリストを返してください。
この報告書を読み、会社名、会計年度、収益、純利益を抽出して表にまとめてください。見つからなかった値は明示してください。
新しいエージェントが作業を引き継げるよう、これまでの会話を、すべての決定事項、未解決の質問、ファイル名を含めた6つの箇条書きで要約してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
Claude Haiku 5.5は何に最も適していますか?
分類、抽出、ルーティング、要約、圧縮、サブエージェントタスクといった、範囲が限定された大量処理に適しています。Anthropicは同社最速のモデルとして販売しており、複雑なエージェントによるコーディングにはSonnet 5.5やOpus 5.5の方が適しているとしています。
Haiku 5.5ではどの努力レベルから始めるべきですか?
Anthropicは、エージェントによるコーディングを含むほとんどの作業において、デフォルトである「medium(中)」を推奨しています。チャット、短いツールタスク、単純な大量リクエストには「low(低)」を使用してください。ただし、長いエージェントプロンプトでは検索をスキップしたり、早期に停止したりする可能性があります。厳密な指示に従わせる場合は「high(高)」を使用し、「xhigh(非常に高い)」や「max(最大)」は、自身のテストで向上が確認できた場合にのみ使用してください。
Haiku 5.5で思考をオフにすることはできますか?
部分的に可能です。思考は適応型であり、デフォルトで有効です。思考を無効にして送信すると、努力レベルが「low」「medium」「high」の場合は動作しますが、「xhigh」および「max」ではエラーが返されます。Anthropicが推奨する思考量を減らす方法は、努力レベルを下げることです。思考は出力制限に含まれるため、余裕を持たせてください。
Haiku 5.5はHaiku 4.5とどう違いますか?
Anthropicは、ベンチマークの大幅な向上、コンテキストウィンドウと出力制限の拡大、努力レベルの調整機能、手動の思考予算に代わる適応型思考の導入を報告しています。新しいトークナイザーを使用しているため、同じテキストでもトークン数が増加します。また、安全分類器がHaiku 4.5ではなかった拒否を返す場合があります。
Haiku 5.5ではなくSonnet 5.5を選ぶべきなのはいつですか?
複雑なエージェントによるコーディング、長時間のターミナルセッション、持続的な判断が必要なタスクには、引き続き強力であるとAnthropicが述べているSonnet 5.5またはOpus 5.5を選択してください。速度と処理量が重要で、分類、要約、サブエージェント作業のようにタスクの範囲が限定されている場合は、Haiku 5.5を選択してください。
Claude Haiku 5.5 の料金はいくらですか?
TokenLab では Claude Haiku 5.5 は 入力 $0.03 / 出力 $0.15 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
Claude Haiku 5.5 のコンテキストウィンドウと出力制限は?
Claude Haiku 5.5 は最大 1,000,000 トークンのコンテキストに対応し、1回のレスポンスで最大 128,000 トークンまで出力可能です。
Claude Haiku 5.5 はどのエンドポイントを使うべきですか?
Claude Haiku 5.5 のデフォルトは https://api.tokenlab.sh/v1/messages です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
Claude Haiku 5.5 はどの操作に対応していますか?
Claude Haiku 5.5 は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
Claude Haiku 5.5 を比較する
ソース
- Introducing Claude Haiku 5.5
- Claude Haiku 5.5 model overview
- What's new in Claude Haiku 5.5
- Prompting Claude Haiku 5.5
2026/10/08 時点での評価