為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

TokenLab 部落格

實用教學、模型觀察與產品更新

5 分鐘內從 OpenAI 遷移至 TokenLab
Tutorial

5 分鐘內從 OpenAI 遷移至 TokenLab

從 OpenAI 遷移至 TokenLab,首先需要更改 `base_url` 和 `api_key`,接著根據過時的說明文件,檢查 model ID、串流(streaming)、工具呼叫(tool calls)、錯誤格式(error shapes)、逾時設定(timeouts)以及計費方式。

9月19日
LLM Latency 與 Throughput:API 買家該如何衡量速度
洞察

LLM Latency 與 Throughput:API 買家該如何衡量速度

TokenLab 的一份過時的四模型串流範例顯示了為何必須分別測量首個可見 token (first visible token)、總時間 (total time) 以及每秒 token 數 (tokens per second),並需配合測試工具 (harness)、用於記錄的標頭 (headers) 以及速率限制計算 (rate-limit math)。

9月19日
用於快速 Agent 迴圈的 Gemini 3.5 Flash API
Tutorial

用於快速 Agent 迴圈的 Gemini 3.5 Flash API

因為模型字串變更而導致 404 錯誤,絕對不是啟動 Agent 迴圈的好開始。以下說明如何鎖定 `gemini-3.5-flash`、讀取 Google Cloud 定價,並建立一個能應對棄用(deprecations)的迴圈。

9月19日