每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

TokenLab 博客

实用教程、模型观察与产品更新

5 分钟内从 OpenAI 迁移至 TokenLab
教程

5 分钟内从 OpenAI 迁移至 TokenLab

从 OpenAI 迁移到 TokenLab,首先需要更改 `base_url` 和 `api_key`,然后根据过时的文档检查模型 ID、流式传输(streaming)、工具调用(tool calls)、错误格式(error shapes)、超时设置(timeouts)以及计费情况。

9月19日
LLM 延迟与吞吐量:API 买家应如何衡量速度
洞察

LLM 延迟与吞吐量:API 买家应如何衡量速度

一份来自 TokenLab 的过时四模型流式传输示例展示了为什么必须使用测试工具、日志记录头文件以及速率限制算法,分别对首个可见 token、总耗时和每秒 token 数进行测量。

9月19日
用于快速 Agent 循环的 Gemini 3.5 Flash API
教程

用于快速 Agent 循环的 Gemini 3.5 Flash API

因为模型字符串变动而遇到 404 错误,这对于启动 Agent 循环来说是一个糟糕的开始。以下是如何固定 `gemini-3.5-flash`、读取 Google Cloud 定价,并构建一个能够应对弃用问题的循环的方法。

9月19日