各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Moonshot: Kimi K3

1Mのコンテキストと、長期間のエージェント作業向けに切り替え可能な最大効率の推論機能を備えたマルチモーダルKimiモデル。
モデルを比較
kimi-k3
利用可能Moonshotチャット
入力 / 出力
$3.00 / $15.00
コンテキスト
1M
最大出力
128K
モダリティ
ビジョンチャット
機能
ツール利用プロンプトキャッシュ推論

Kimi K3 について

Kimi K3は、2026年7月にリリースされたMoonshot AIのオープンウェイトのフラッグシップモデルです。2.8兆パラメータのMixture-of-Experts(MoE)モデルで、ネイティブな画像・動画入力と100万トークンのコンテキストを備えています。思考プロセスは常に有効で、低・高・最大の設定が可能です。Kimi Delta Attentionを採用し、トークンごとに896個の専門家(エキスパート)のうち16個を活性化します。Moonshotは、長期的なエージェント、大規模なコードベース、ナレッジワークのためにこのモデルを構築しました。

得意なこと

  • 推論の努力レベルを低・高・最大に設定できるため、迅速な回答から深い問題解決まで1つのモデルで対応可能です。
  • 100万トークンのコンテキストを備え、大規模なコードベースや長いエージェント履歴を対象としています。
  • ネイティブな画像・動画入力に対応しており、グラフ、スクリーンショット、録画をタスクの一部として含めることができます。
  • JSON出力、動的読み込みを伴うツール呼び出し、プレフィックス継続、自動コンテキストキャッシュをサポートしています。

他のモデルを検討すべきケース

  • 思考プロセスが常に有効なため、些細なやり取りであっても、思考を行わないモデルよりも時間がかかります。
  • この規模のモデルは、ウェイトが公開されていても自己ホストするには非常に負荷が高いです。
  • 出力はテキストのみです。画像や音声の生成には別のモデルを使用してください。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストResponses API
    POST/v1/responses
    API形式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "kimi-k3",
        "input": "Hello!"
      }'

料金

Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。

Default

100万トークンあたり
Official 価格
入力 $3.00 / 出力 $15.00 / キャッシュ読み取り $0.30 / キャッシュ書き込み $3.00 / テキスト 入力 $3.00 / テキスト 出力 $15.00
Verified 価格
—
割引
—
プロンプトキャッシュ料金

キャッシュ読み取り

Official 価格
$0.30
Verified 価格
—
割引
—

キャッシュ書き込み

Official 価格
$3.00
Verified 価格
—
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
30日間の成功率
99.2%
30日間のリクエスト数
100+
最終利用
6 分前

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでKimi K3を開き、プロンプトを編集・送信できます。

kimi-k3と/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

向いている用途
  • 推論
  • ビジョン
  • 長期的なエージェント

    数百回のツール呼び出しを行い、非常に長いセッションを通じて過去の結果を記憶する必要がある研究やエンジニアリングのエージェントを実行します。

  • 大規模なコードベースの作業

    検索だけに頼るのではなく、コードベースの大部分をコンテキストに読み込むことで、巨大なリポジトリをナビゲートし変更を加えます。

  • 動画とグラフの分析

    録画されたデモや密度の高いグラフについて質問し、画面上の内容を引用した分析結果を受け取ります。

  • ナレッジワークの自動化

    ツールを使用してデータを取得し数値を検証しながら、大量のドキュメントセットからレポートや分析をドラフトします。

プロンプト例

添付された600ページの提出書類をレビューし、関連当事者取引をすべてページ番号と共にリストアップしてください。

このリポジトリを読み込み、リクエストがルーターからデータベースへどのように流れるかを、各ファイル名を挙げて説明してください。

この製品デモ動画を見て、フォームがリセットされるステップのバグ報告書を作成してください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Kimi K3とは何ですか?

2.8兆パラメータのMixture-of-Experts設計を採用した、Moonshot AIのオープンウェイトのフラッグシップモデルです。テキスト、画像、動画を読み取り、100万トークンのコンテキストを持ち、調整可能な努力レベルで思考してから回答します。

推論の努力レベルとは何ですか?

低、高、最大があります。思考プロセスは常に有効で、努力レベルによってモデルがどれだけ深く検討するかが決まります。日常的なリクエストには「低」を、困難なデバッグ、計画、分析には「最大」を使用してください。

Kimi K3はオープンソースですか?

MoonshotはAPIの立ち上げ後にウェイトを公開したため、ハードウェアがあれば自己ホストが可能です。API経由で呼び出せばそのコストを回避でき、再デプロイなしでモデルを切り替えることができます。

動画入力に対応していますか?

はい。Moonshotは画像と動画のネイティブサポートを謳っており、テキストによる指示と併せて、画面録画、デモ、グラフの分析に適しています。出力はテキストのままなので、分析結果は文章として返ってきます。

Kimi K2.6と何が違いますか?

K3はより新しく、はるかに大規模なモデルです。100万トークンのウィンドウ、設定可能な努力レベル、そしてMoonshotによればより効率的なスケーリングを備えています。K2.6はコンテキストが短く、努力レベルの設定はありません。

Kimi K3 の料金はいくらですか?

TokenLab では Kimi K3 は 入力 $3.00 / 出力 $15.00 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Kimi K3 のコンテキストウィンドウと出力制限は?

Kimi K3 は最大 1,048,576 トークンのコンテキストに対応し、1回のレスポンスで最大 131,072 トークンまで出力可能です。

Kimi K3 はどのエンドポイントを使うべきですか?

Kimi K3 のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Kimi K3 はどの操作に対応していますか?

Kimi K3 は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Kimi K3 を比較する

ソース

2026/10/02 時点での評価

Kimi の他のモデル

関連モデル