xAI: Grok 4.20
grok-4.20- 入力 / 出力-50%
- $1.25 / $2.50$0.625 / $1.25
- コンテキスト
- 1M
- 最大出力
- 128K
- モダリティ
- ビジョンチャット
- 機能
- ツール利用プロンプトキャッシュ推論
Grok 4.20 について
Grok 4.20は、xAIの4.20ファミリーにおける推論対応モデルであり、非常に長い入力に対するツール呼び出しワークフローのために構築されています。テキストと画像を読み取り、テキストを出力します。回答前に思考を行う点が、同じファミリー名を持つ非推論モデルやマルチエージェントモデルとの違いです。多数のドキュメント、スクリーンショット、中間的なツール結果を統合して回答を導き出す必要がある場合に適しています。
得意なこと
- 回答前に問題を推論するため、多段階の質問に対しては、最初の推測ではなく、検討された回答が得られます。
- テキストに加えて画像を受け入れるため、1つの会話の中でスクリーンショット、グラフ、文章を混在させることができます。
- ツールを呼び出し、構造化されたJSONを返すため、エージェントループや抽出パイプラインの中に組み込むことができます。
- 非常に長い会話履歴を扱えるため、多くのやり取りを通じて証拠を蓄積する調査に役立ちます。
- プロンプトキャッシングにより、リクエスト間で大きな共通プレフィックスを再送信するコストを削減します。
他のモデルを検討すべきケース
- 思考ステップには遅延が伴います。単純なドラフト作成や抽出タスクの場合、非推論型の4.20バリアントの方が高速に応答します。
- 4.7などの新しいGrokリリースは、コーディングやエージェント作業をより直接的なターゲットとしており、困難なソフトウェアタスクにおいてより優れた性能を発揮する可能性があります。
- 出力はテキストのみであるため、画像、音声、動画を生成することはできません。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストResponses APIPOST/v1/responsesAPI形式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20", "input": "Hello!" }'
料金
Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。
入力 トークン <= 200K
100万トークンあたり- 公式価格
- 入力 $1.25 / 出力 $2.50 / キャッシュ読み取り $0.20
- TokenLab 価格
- 入力 $0.625 / 出力 $1.25 / キャッシュ読み取り $0.10
- 割引
- -50%
入力 トークン > 200K
100万トークンあたり- 公式価格
- 入力 $2.50 / 出力 $5.00 / キャッシュ読み取り $0.40
- TokenLab 価格
- 入力 $1.25 / 出力 $2.50 / キャッシュ読み取り $0.20
- 割引
- -50%
キャッシュ読み取り
- 公式価格
- $0.20
- TokenLab 価格
- $0.10
- 割引
- -50%
| 公式価格100万トークンあたり | TokenLab 価格100万トークンあたり | 割引 | |
|---|---|---|---|
| 入力 トークン <= 200K | 入力 $1.25 / 出力 $2.50 / キャッシュ読み取り $0.20 | 入力 $0.625 / 出力 $1.25 / キャッシュ読み取り $0.10 | -50% |
| 入力 トークン > 200K | 入力 $2.50 / 出力 $5.00 / キャッシュ読み取り $0.40 | 入力 $1.25 / 出力 $2.50 / キャッシュ読み取り $0.20 | -50% |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.20 | $0.10 | -50% |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでGrok 4.20を開き、プロンプトを編集・送信できます。
grok-4.20と/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
向いている用途- 推論
- ビジョン
証拠に基づく調査
インシデントや監査中に収集されたレポート、エクスポートデータ、スクリーンショットを入力し、推論に基づいたタイムラインと残された未解決の質問を提示させます。
ツールを用いたエージェントループ
検索、データベース、チケット管理などの機能を付与し、モデル自身に呼び出しの判断、結果の読み取り、そして質問が解決するまでの継続を行わせます。
複雑な入力からの構造化抽出
スキャンされたフォーム、請求書、チャットログを固定のJSONスキーマに変換します。推論ステップが曖昧な項目の処理を支援します。
プロンプト例
3つのログエクスポートとダッシュボードのスクリーンショットが続きます。障害のタイムラインを作成し、ログと矛盾する箇所があれば指摘してください。
この請求書の画像から、ベンダー、日付、明細項目、税金を抽出し、以下のスキーマに一致するJSON形式で出力してください。確信が持てない項目にはマークを付けてください。
search_ordersとget_customerを呼び出すことができます。顧客から注文8812に2つのアイテムが不足しているとの連絡がありました。何を確認すべきか、どのような順序で行うべきかを検討してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
Grok 4.20とは何ですか?
Grok 4.20は、テキストと画像を受け取り、テキストで回答するxAIのチャットモデルです。これはファミリー内の推論バージョンであり、回答前に問題を検討します。xAIは同じ生成能力を持つ非推論型やマルチエージェント型のモデルも提供しています。
grok-4.20とgrok-4.20-non-reasoningの違いは何ですか?
ベースIDは回答前に推論に時間を費やしますが、非推論IDは直接回答します。数段階の分析が必要な質問にはベースIDを使用し、速度が深さよりも重要なドラフト作成、抽出、チャットには非推論型を使用してください。
Grok 4.20は画像を読み取れますか?
はい。テキストと一緒にスクリーンショット、グラフ、撮影されたドキュメントなどの画像を送信し、同じ会話の中でそれらについて質問することができます。回答はテキストで行われます。モデルは画像を生成したり編集したりすることはありません。
Grok 4.20はツール呼び出しとJSON出力をサポートしていますか?
はい。関数呼び出しと構造化されたJSON応答をサポートしているため、独自の関数に接続したり、回答を特定のスキーマに強制したりできます。これにより、抽出ジョブや外部システムで動作するエージェントに使用可能です。
既存のOpenAIスタイルのクライアントをGrok 4.20で使用できますか?
はい。モデル名を変更するだけで既存のOpenAIスタイルのクライアントコードが動作します。ツール定義やJSONスキーマも、現在送信しているものと同じフィールドを使用します。
Grok 4.20 の料金はいくらですか?
TokenLab では Grok 4.20 は 入力 $0.625 / 出力 $1.25 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
Grok 4.20 のコンテキストウィンドウと出力制限は?
Grok 4.20 は最大 1,000,000 トークンのコンテキストに対応し、1回のレスポンスで最大 131,072 トークンまで出力可能です。
Grok 4.20 はどのエンドポイントを使うべきですか?
Grok 4.20 のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
Grok 4.20 はどの操作に対応していますか?
Grok 4.20 は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
Grok 4.20 を比較する
ソース
2026/10/02 時点での評価