
Prompt Cachingコストガイド:キャッシュヒット、プレフィックス、および実際のAPI利用料金
20,000-tokenのシステムプロンプトは、TokenLabが2026-10-03に観測した価格に基づくと、claude-sonnet-5においてキャッシュなしで1,000リクエストあたり推定18.18ドル、キャッシュヒット時は約2.00ドルとなります。
各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る
TokenLab ブログ

20,000-tokenのシステムプロンプトは、TokenLabが2026-10-03に観測した価格に基づくと、claude-sonnet-5においてキャッシュなしで1,000リクエストあたり推定18.18ドル、キャッシュヒット時は約2.00ドルとなります。

OpenRouterとTokenLabの技術的な比較。OpenAI、Anthropic、Geminiエンドポイントにわたる単一スキーマ正規化とマルチフォーマットネイティブゲートウェイルーティングを検証します。

OpenAIからTokenLabへの移行は、`base_url`と`api_key`の変更から始まり、その後、モデルID、ストリーミング、ツール呼び出し、エラーの形式、タイムアウト、および課金について、古いドキュメントと照らし合わせながら確認する作業が必要です。

コーディングエージェントは、モデル名の変更によって動作が停止するべきではありません。ここでは、MCPモデルカタログを使用してモデルの選択をランタイムルックアップにする方法を、リクエスト例、ルーティングルール、および検証の習慣とともに解説します。

TokenLabによる4つのモデルを用いた古いストリーミングのサンプルは、最初のトークンが表示されるまでの時間(first visible token)、合計時間、および1秒あたりのトークン数(tokens per second)を、ハーネス、ログ記録用のヘッダー、そしてレート制限の計算を用いて個別に測定しなければならない理由を示しています。

モデル文字列の変更によって404エラーが発生するのは、エージェントループの開始としては最悪です。ここでは、`gemini-3.5-flash` を固定し、Google Cloudの料金体系を読み取り、非推奨化に耐えうるループを構築する方法を解説します。