エージェントパイプラインにおいて、トークン単価が最も安いモデルが、タスク完了あたりのコストも最も安いとは限りません。エージェント向けのベストな低コストAIモデルをテストしたところ、ツール呼び出し、JSON修復、Chain-of-Thought(思考の連鎖)による出力トークンが支出の大半を占めることが分かりました。DeepSeek V4 Flash、Gemini 3.5 Flash、Claude Sonnet 5、GPT-5.5、GLM-5.2、およびLaguna XS 2.1が、現在議論可能なSSOT(信頼できる唯一の情報源)の例です。以下のTokenLabカタログ価格は2026年9月19日時点の観測値であり、外部価格には日付がなく、プロバイダーによる確認が必要です。リフレッシュ時点でこれらの正確なルートに対する制御されたTTFT、トークン/秒、または再試行率のデータセットが利用できなかったため、レイテンシのベンチマークは公開していません。これをコストと失敗モードのショートリストとして扱い、実際のループ内でレイテンシをベンチマークしてください。
重要なポイント
- エージェントの支出は、入力コストよりも出力コストによって左右されます。エージェントは、1ターンあたりの消費量よりも、ツール呼び出し、再試行、JSON生成を通じてはるかに多くのトークンを生成します。
- TokenLabカタログ価格を持つ現在のSSOT例の中で、DeepSeek V4 Flashは、入力$0.147 / 出力$0.294(MTokあたり)という、ここで検証可能な最も低い出力コストのモデルです。
- モデル名の重複は実際に存在します。DeepSeek V4 Flashは、TokenLabカタログでは$0.147/$0.294、外部リストでは$0.09/$0.18という2つの価格ポイントで表示されています。
- 動画および画像生成の価格設定(PixVerse、fal、Black Forest Labs)は、LLMトークン価格の根拠にはなりません。テキストエージェントのコストの引用として使用すべきではなく、以下では分離しています。
- Claude Sonnet 5、GLM-5.2、Kimi K2.7 Code、Qwen3.7 Plusなどの外部比較価格には、日付付きの公開ソースURLがありません。予算を組む前に、各プロバイダーの価格ページで確認してください。
- トークン単価が最も安いことが、自動的にタスク単価が最も安いことにはなりません。ツール呼び出しに失敗したり、JSONを切り詰めたりするモデルは再試行を強制し、節約分を帳消しにします。
ソーススナップショットと失敗モード
| ソース | コンテンツタイプ | 観測日 | 本記事との関連性 |
|---|---|---|---|
| PixVerse Platform Docs (docs.platform.pixverse.ai) | 動画生成価格 | 2026-07-08 | LLMの主張には不使用 - 動画専用、透明性のために記載 |
| fal PixVerse V6 model page (fal.ai/pixverse-v6) | 動画生成価格 | 2026-07-08 | LLMの主張には不使用 - 動画専用 |
| Black Forest Labs pricing docs (docs.bfl.ml) | 画像生成価格 | 2026-07-08 | LLMの主張には不使用 - 画像専用 |
| TokenLab internal model catalog | ファーストパーティLLMおよびメディア価格 | 2026-09-19 | 以下のすべてのTokenLabカタログ価格の主要ソース |
| 各プロバイダーの価格ページ (OpenAI, Anthropic, Google, DeepSeek, Moonshot, Qwen, MiniMax, Z.ai) | LLM価格 | 本データセットでは日付なし | 公開予算の主張の前に独自に検証が必要 |
PixVerse、fal、BFLのソースは、より広範なメディア価格調査の過程で取得したため、研究セットに含まれています。これらは秒単位の動画課金や画像単位のクレジットコストを記述しており、トークン単位のLLM価格とは無関係です。これらを除外する理由を読者が理解できるよう、ここにリストアップしています。LLMに関する主張には使用していません。
当社のパイプラインでは、トークン支出と並行して、ツール呼び出しの再試行率、切り詰められたJSON、見逃されたツール呼び出し、ハルシネーション(幻覚)による関数引数をログに記録しています。リフレッシュ時点でこれらの正確なルートに対する制御された再試行率データセットがないため、数値を公開することはできません。例えば、ツール呼び出しで15%失敗する$0.05/MTokのモデルは、2%失敗する$1/MTokのモデルよりも再試行コストが高くなる可能性があります。定価ではなく、この失敗モードの計算が、低コスト層を選択する際の判断基準となるべきです。
エージェント向けベスト低コストAIモデルのモデルおよびコスト比較
以下のすべての価格は、2026年9月19日時点で観測されたTokenLab独自のファーストパーティカタログリスト(トークン単位、$/MTok表記)です。これらは、本記事におけるLLMエージェントのコスト主張の正しい根拠となります。
| モデル | プロバイダー | 入力 $/MTok | 出力 $/MTok | エージェント適合性 |
|---|---|---|---|---|
| DeepSeek V4 Flash | DeepSeek | $0.147 | $0.294 | TokenLabカタログで最も安い出力重視のSSOTオプション。外部見積もりと比較する前に正確なモデルIDを確認すること |
| Gemini 3.5 Flash | $1.50 | $9.00 | マルチモーダルエージェントステップ(画像+テキストツール使用) | |
| Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | エージェント出力の最終検証/QAパス用に確保 |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | 複雑な計画や曖昧なツール選択のためのフォールバック |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | フラッグシップ比較用。エージェントループ内での使用は稀 |
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | プレミアム上限 |
| GLM-5.2 | Z.ai | $0.93 | $3.00 | 低コストルーティング用のオープンウェイト例 |
| Kimi K2.7 Code | Moonshot AI | $0.74 | $3.50 | コーディングエージェント例 |
| Qwen3.7 Plus | Alibaba/Qwen | $0.32 | $1.28 | 低コストルーティング例 |
| MiniMax M3 | MiniMax | $0.30 | $1.20 | 低コストルーティング例 |
| DeepSeek V4 Pro | DeepSeek | $0.441 | $0.882 | 同ファミリー内のより重い推論サブタスク |
監査の継続性のために以下の外部数値を保持し、各行を「未検証」とマークしています。予算編成には使用しないでください。正確な詳細は、現在のドキュメントと照らし合わせて確認する必要があります。
| モデル | プロバイダー | 入力 $/MTok | 出力 $/MTok | 検証ステータス |
|---|---|---|---|---|
| DeepSeek V4 Flash (外部リスト) | DeepSeek | $0.09 | $0.18 | 上記のTokenLabカタログと異なる。どの製品/ティアを指すか確認が必要。ソースセット内に日付付きURLなし |
| MiniMax M3 | MiniMax | $0.30 | $1.20 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| Qwen3.7 Plus | Alibaba/Qwen | $0.32 | $1.28 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| Kimi K2.7 Code | Moonshot AI | $0.74 | $3.50 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| GLM-5.2 | Z.ai | $0.93 | $3.00 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| GPT-5.5 Batch/Flex | OpenAI | $2.50 | $15.00 | ソースセット内に日付付きURLなし。標準のGPT-5.5行ではない |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | ソースセット内に日付付きURLなし。プロバイダーのドキュメントで確認 |
廃止されたカタログ価格ポイントは、現在のSSOTモデル名と一致しなくなりました。監査の継続性のために数値を保持していますが、プロバイダーによる確認なしに、これらの名前のないティアに新しいエージェントワークをルーティングすることはありません。
| 廃止または非SSOTティア | 入力 $/MTok | 出力 $/MTok | ステータス |
|---|---|---|---|
| 廃止された超低コストティア | $0.05 | $0.40 | 現在のSSOT例ではない。使用前に後継を確認すること |
| 廃止された低コストflash-liteティア | $0.25 | $1.50 | 現在のSSOT例ではない。Gemini 3.5 FlashまたはDeepSeek V4 Flashにマッピングして確認すること |
| 廃止された低コストminiティア | $0.25 | $2.00 | 現在のSSOT例ではない。Claude Sonnet 5またはDeepSeek V4 Flashにマッピングして確認すること |
| 廃止された小規模検証ティア | $1.00 | $5.00 | 現在のSSOT例ではない。Claude Sonnet 5にマッピングして確認すること |
| 廃止された中ティアフォールバック | $1.25 | $10.00 | 現在のSSOT例ではない。GPT-5.5にマッピングして確認すること |
| 廃止されたプレミアム上限 | $15.00 | $120.00 | 現在のSSOT例ではない。GPT-5.5またはClaude Fable 5にマッピングして確認すること |
エージェント向けベスト低コストAIモデルの実装ノート
- 単一の最安モデルではなく、タスクごとにエージェントをティア分けしてください。ルーティング、分類、ツール選択はDeepSeek V4 FlashまたはGemini 3.5 Flashに割り当てます。多段階の計画はDeepSeek V4 ProまたはGPT-5.5にエスカレーションします。最終回答の検証にはClaude Sonnet 5を確保してください。
- 低コストティアでは出力トークンを積極的に制限してください。出力コストがエージェントの支出を支配するため、DeepSeek V4 FlashおよびGemini 3.5 Flashの呼び出しには厳しい最大トークン制限を設定します。より長い生成はエスカレーションティアでのみ許可してください。
- 呼び出しごとのコストだけでなく、モデルごとの失敗モードをログに記録してください。切り詰められたJSON、見逃されたツール呼び出し、ハルシネーションによる関数引数をトークン支出とは別に追跡します。例えば、ツール呼び出しで15%失敗する$0.05/MTokのモデルは、2%失敗する$1/MTokのモデルよりも再試行コストが高くなる可能性があります。
- コード内ではエイリアスではなく、正確なモデルIDを指定してください。上記で示した命名の衝突(2つの異なるDeepSeek V4 Flashの価格ポイント)を考慮し、ベンダーとモデルのフル文字列をハードコードしてください。プロバイダーの更新ごとに価格を再検証してください。
- 外部価格を四半期ごとに再確認してください。本記事に日付付きソースURLがないものは、顧客向けのコスト見積もりに含める前に、プロバイダーのライブ価格ページから再取得する必要があります。
以下は、本記事のカタログモデル名を使用したルーティングのスケッチです。正確なTokenLabのリクエスト形状とツール呼び出しエラーフィールドは、本番環境で使用する前にTokenLab APIドキュメントで確認する必要があります。
Routing sketch, not a TokenLab API contract. Confirm the request shape in the TokenLab API docs.
for model in ['DeepSeek V4 Flash', 'Gemini 3.5 Flash', 'Claude Sonnet 5']:
retry once if the tool call is missing or the JSON is truncated
if the response contains a valid tool call and valid JSON:
return the response
log the failure mode for this model
raise an error after the final tier fails
このスケッチは再試行の境界を示しています。ツール呼び出しエラーをキャッチし、失敗モードをログに記録してから、次のモデルに移行します。本番環境の前に、現在のTokenLab APIドキュメントでリクエスト形状とエラーフィールドを確認してください。
TokenLabがエージェントルーティングに適合する理由
- 単一のカタログにより、ベンダーごとのアカウント管理の手間が削減されます。TokenLabは、OpenAI、Google、Anthropic、DeepSeekの価格ティアを1つのAPIおよび請求インターフェースで公開しています。ワークフローのステップをDeepSeek V4 FlashからGemini 3.5 Flashに切り替えることは、新しい統合ではなく設定変更になります。
- 監査可能なファーストパーティの日付付き価格。断片的なサードパーティの見積もりとは異なり、本記事のTokenLabカタログ数値は、2026年9月19日時点で観測されたプラットフォーム自身のリストから取得されています。そのため、これらは「検証必須」という注意書きなしで提示されている唯一の価格です。
- エージェントパイプラインのための組み込みティアリング。TokenLabは低コストティアとエスカレーションティアの両方のモデルを並べてホストしているため、DeepSeek V4 Flash、Gemini 3.5 Flash、Claude Sonnet 5の間でコストと失敗率をA/Bテストできます。エージェントのルーティングロジックを再設計する必要はありません。
関連資料
FAQ
DeepSeek V4 Flashの価格が2つあるのはなぜですか?
DeepSeek V4 Flashは、ソースセット内でTokenLabのカタログでは$0.147/$0.294、外部リストでは$0.09/$0.18という2つの価格ポイントで表示されています。モデル名は、プロバイダーやリセラー間で再利用され、再価格設定されます。コード内で正確なベンダーとモデルIDを固定し、名前だけで信頼するのではなく、プロバイダーのライブドキュメントと照らし合わせて再検証してください。
予算編成に外部参照価格を使用できますか?
まだできません。それらの行にはソースセット内に日付付きのソースURLがないため、プロバイダーによる確認が必要であるとマークしています。TokenLabのカタログ数値が計画の根拠であり、外部テーブルは独自の検証を開始するための出発点であり、最終的な数値ではありません。正確な詳細は、現在のドキュメントと照らし合わせて確認する必要があります。
本番エージェントにとって最も安い現在のSSOTモデルはどれですか?
TokenLabカタログ価格を持つ現在のSSOT例の中で出力コストを比較すると、DeepSeek V4 Flashが$0.294/MTok(出力)で最も低い検証可能なモデルです。外部リストには$0.18/MTok(出力)とありますが、その数値はプロバイダーによる確認が必要です。特定のツール呼び出しスキーマにおける再試行率を考慮した上で、最も安いものを測定してください。
この記事がLLM価格に関するものなのに、なぜPixVerse、fal、BFLが引用されているのですか?
これらはLLM価格の主張の根拠として引用されているわけではありません。これらは、より広範な調査範囲に関する透明性を確保するために「ソーススナップショット」テーブルにのみ表示されており、LLMの主張には使用していないことが明記されています。「モデルおよびコスト比較」テーブルのすべてのドル数値は、TokenLab独自のカタログから取得されているか、未検証としてフラグが立てられています。
ツール呼び出しの再試行は、最も安いモデルの選択にどのように影響しますか?
ツール呼び出しに失敗したり、JSONを切り詰めたりする安価なモデルは再試行を強制し、その再試行によって出力トークンが追加されます。例えば、ツール呼び出しで15%失敗する$0.05/MTokのモデルは、2%失敗する$1/MTokのモデルよりも再試行コストが高くなる可能性があります。当社のパイプラインでは、モデルごとの再試行率をログに記録し、トークン単価ではなくタスク完了あたりのコストを比較しています。
TokenLabモデルカタログを探索し、今すぐコスト比較を始めましょう:TokenLabモデルカタログ。
出典
価格確認日 2026-07-07
- PixVerse Platform Docs2026-07-08 時点で確認
- fal PixVerse V6 model page2026-07-08 時点で確認
- Black Forest Labs pricing docs2026-07-08 時点で確認
- fal FLUX.2 model page2026-07-08 時点で確認
- Google AI Gemini API pricing2026-07-08 時点で確認
- Claude Platform pricing2026-07-08 時点で確認
- OpenAI API pricing2026-07-08 時点で確認
- DeepSeek API pricing2026-07-08 時点で確認



