コアガイド
信頼できる TokenLab 連携
信頼できる TokenLab 連携
モデルと費用
モデル API またはモデルページで現在の機能と価格を確認し、同じタスクで比較します。各リクエストでモデルを明示してください。モデル変更は価格、品質、ツール、コンテキストに影響するため、無断で切り替えないでください。
API 形式とモデルに合う出力上限を設定し、重複する文脈を減らします。メディアの料金は個数、時間、解像度などで変わります。高額な生成は利用可能な見積もりを確認前に表示します。
ストリーミングと再試行
ストリーミングは文字を早く表示できますが、トークン料金は減りません。切断後の部分出力は、完全な回答として扱わないでください。
429 では Retry-After または retry_after を待ち、一時的な 5xx では短いバックオフを使います。認証、権限、残高、入力やコンテキストのエラーは修正が必要です。回数と総時間を制限し、SDK の自動再試行との重複を避けます。
キーの保護と記録
API キーはサーバー環境または秘密情報管理に保存します。ブラウザー、アプリ配布物、公開リポジトリ、ログには含めません。開発、本番、独立したアプリでキーを分け、モデルと支出を制限します。漏えい時は直ちに失効させます。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["TOKENLAB_API_KEY"],
base_url="https://api.tokenlab.sh/v1",
timeout=30.0,
max_retries=0,
)request_id、task_id、返された billing_transaction_id、モデル、エンドポイント、自分のジョブ ID を記録します。認証情報、私的なプロンプト全文、メディア、署名付き URL は記録しません。最終料金は Console Usage または管理 API の利用記録で確認します。
非同期処理
非同期作成が成功したらタスク ID と poll_url を保存し、completed または failed まで確認します。状態取得の失敗は生成失敗ではありません。タイムアウトや再読み込み後は保存済みタスクを確認し、対応エンドポイントでは冪等キーを使います。
公開前の確認
公開前に使用するモデルと形式、成功と主なエラー、現在の価格、再読み込みと重複クリックの動作を確認してください。