コアガイド

信頼できる TokenLab 連携

信頼できる TokenLab 連携

モデルと費用

モデル API またはモデルページで現在の機能と価格を確認し、同じタスクで比較します。各リクエストでモデルを明示してください。モデル変更は価格、品質、ツール、コンテキストに影響するため、無断で切り替えないでください。

API 形式とモデルに合う出力上限を設定し、重複する文脈を減らします。メディアの料金は個数、時間、解像度などで変わります。高額な生成は利用可能な見積もりを確認前に表示します。

ストリーミングと再試行

ストリーミングは文字を早く表示できますが、トークン料金は減りません。切断後の部分出力は、完全な回答として扱わないでください。

429 では Retry-After または retry_after を待ち、一時的な 5xx では短いバックオフを使います。認証、権限、残高、入力やコンテキストのエラーは修正が必要です。回数と総時間を制限し、SDK の自動再試行との重複を避けます。

キーの保護と記録

API キーはサーバー環境または秘密情報管理に保存します。ブラウザー、アプリ配布物、公開リポジトリ、ログには含めません。開発、本番、独立したアプリでキーを分け、モデルと支出を制限します。漏えい時は直ちに失効させます。

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["TOKENLAB_API_KEY"],
    base_url="https://api.tokenlab.sh/v1",
    timeout=30.0,
    max_retries=0,
)

request_id、task_id、返された billing_transaction_id、モデル、エンドポイント、自分のジョブ ID を記録します。認証情報、私的なプロンプト全文、メディア、署名付き URL は記録しません。最終料金は Console Usage または管理 API の利用記録で確認します。

非同期処理

非同期作成が成功したらタスク ID と poll_url を保存し、completed または failed まで確認します。状態取得の失敗は生成失敗ではありません。タイムアウトや再読み込み後は保存済みタスクを確認し、対応エンドポイントでは冪等キーを使います。

非同期ジョブとポーリング

公開前の確認

公開前に使用するモデルと形式、成功と主なエラー、現在の価格、再読み込みと重複クリックの動作を確認してください。

このページの内容