各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Anthropic: Claude Haiku 4.5

軽量エージェント、オフィス業務、応答性の高いチャット向けの高速Claudeレーン
モデルを比較
claude-haiku-4-5
利用可能Anthropicチャット入力キャッシュで90%オフ
入力 / 出力-70%
$1.00 / $5.00$0.30 / $1.50
コンテキスト
200K
最大出力
64K
モダリティ
ビジョンチャット
機能
ツール利用プロンプトキャッシュ推論

Claude Haiku 4.5 について

Claude Haiku 4.5は、2025年10月にリリースされた、大量処理や低遅延が求められる作業向けのAnthropicの小型・高速モデルです。Anthropicは、同社のラインナップの中で最も高速でありながら、フロンティアモデルに近い知能を持つと説明しています。テキストと画像を受け付け、ツール使用やプロンプトキャッシングをサポートし、新しいClaudeモデルのような適応型思考ではなく、トークン予算を指定する手動の拡張思考(Extended thinking)を使用します。

得意なこと

  • Anthropicの概要ページに記載されているClaudeモデルの中で最も低遅延であり、チャットフロントエンドやリアルタイムアシスタントに適しています。
  • テキストと並行して画像を読み取れるため、スクリーンショット、領収書、グラフなどを大量に分類できます。
  • 拡張思考はオプションであり、明示的なトークン予算を設定することで、リクエストごとに推論にどれだけコストをかけるかを決定できます。
  • ツール使用、構造化されたJSON出力、プロンプトキャッシングをサポートしており、エージェントループ内での繰り返しシステムプロンプトを低コストに抑えられます。

他のモデルを検討すべきケース

  • 知識のカットオフ時期がClaude 5世代よりも大幅に早いため、最近のライブラリや出来事に関する知識は限定的です。
  • OpusやSonnet 5.xモデルよりもコンテキストウィンドウと出力上限が小さいため、リポジトリ全体や書籍規模の作業には制限があります。
  • 長期的な自律コーディングや、曖昧な多段階計画の実行には、SonnetやOpusモデルの方が失敗が少なくなります。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストMessages API
    POST/v1/messages
    API形式:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-4-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

料金

VerifiedはTokenLab価格で低コストに、Officialは提供元の価格で高い信頼性を提供します。Autoはリクエストを完了したルートの料金を適用します。

デフォルト仕様

100万トークンあたり
公式価格
入力 $1.00 / 出力 $5.00 / キャッシュ読み取り $0.10 / キャッシュ書き込み $1.25
TokenLab 価格
入力 $0.30 / 出力 $1.50 / キャッシュ読み取り $0.03 / キャッシュ書き込み $0.375
割引
-70%
プロンプトキャッシュ料金

キャッシュ読み取り

公式価格
$0.10
TokenLab 価格
$0.03
割引
-70%

キャッシュ書き込み

公式価格
$1.25
TokenLab 価格
$0.375
割引
-70%
ツール利用料

ツール利用時のみ、呼び出しごとに料金が発生します。

ウェブ検索

公式価格
$0.01/検索
TokenLab 価格
$0.003/検索
割引
-70%

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
30日間の成功率
100.0%
過去7日間の中央値レイテンシ
1 sn=269
7日間のP95レイテンシ
16.1 sn=269
30日間のリクエスト数
100+
最終利用
3 分前

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでClaude Haiku 4.5を開き、プロンプトを編集・送信できます。

claude-haiku-4-5と/v1/messagesでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

向いている用途
  • 推論
  • ビジョン
  • リアルタイムチャットおよびサポート

    応答の深さよりも速度が重視される顧客対応ウィジェットの背後で利用し、注文照会などのツール呼び出しや、複雑な質問へのハンドオフを行うのに適しています。

  • 分類および抽出

    チケットのタグ付け、請求書やスクリーンショットからのフィールド抽出を行い、1日何千回も実行される後続パイプラインのために厳密なJSONを返します。

  • サブエージェントワーカー

    マルチエージェント構成における安価なワーカーとして実行します。大規模モデルが計画を立て、複数のHaiku呼び出しが並行して検索、要約、ファイルチェックを行います。

プロンプト例

このサポートメールを「請求」「バグ」「機能リクエスト」「その他」に分類し、ラベルと1文の理由を含むJSONを返してください。

このチャットのやり取りを3つの箇条書きで要約し、担当者名とともにアクションアイテムをリストアップしてください。

このエラーダイアログのスクリーンショットを見て、ユーザーがどの設定を変更すべきか教えてください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Claude Haiku 4.5は何に最適ですか?

チャットアシスタント、分類、データ抽出、要約、ワーカーエージェントといった、高速かつ大量の処理を必要とするジョブに最適です。Anthropicは、フロンティアモデルに近い知能を持つ最速のClaudeモデルとして位置づけており、最も深い推論よりも応答時間やスループットが重要な場合のデフォルトの選択肢となります。

Claude Haiku 4.5は拡張思考をサポートしていますか?

はい。ただし手動形式です。思考を有効にしてトークン予算を設定します。新しいSonnetやOpusモデルが使用する適応型思考モードや努力量パラメータは使用しないため、渡す予算によって推論の深さを制御します。

Claude Haiku 4.5は画像を処理できますか?

はい。テキストと一緒に画像を受け取り、テキストで回答します。スクリーンショット、グラフ、スキャンされた文書の読み取りが可能です。画像の生成や編集はできないため、画像出力が必要な場合は画像モデルを使用してください。

Haiku 4.5からSonnetへ移行すべきタイミングはいつですか?

Haikuが長いプロンプトで指示を見落としたり、マルチツールエージェントの実行で手順を飛ばしたり、最新のリリースに関する知識が必要になったりした時に移行してください。Sonnet 5.5は次のステップとして適しており、高速なプロファイルを維持しつつ、より長いコンテキストウィンドウと大幅に新しい知識カットオフを備えています。

Claude Haiku 4.5 の料金はいくらですか?

TokenLab では Claude Haiku 4.5 は 入力 $0.30 / 出力 $1.50 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Claude Haiku 4.5 のコンテキストウィンドウと出力制限は?

Claude Haiku 4.5 は最大 200,000 トークンのコンテキストに対応し、1回のレスポンスで最大 64,000 トークンまで出力可能です。

Claude Haiku 4.5 はどのエンドポイントを使うべきですか?

Claude Haiku 4.5 のデフォルトは https://api.tokenlab.sh/v1/messages です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Claude Haiku 4.5 はどの操作に対応していますか?

Claude Haiku 4.5 は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Claude Haiku 4.5 を比較する

Claude Haiku 4.5 を活用するガイド

ソース

2026/10/02 時点での評価

Claude 4 の他のモデル

関連モデル