
对比
Prompt Caching 成本指南:缓存命中、前缀与实际 API 开销
根据 TokenLab 在 2026-10-03 观察到的价格,在 claude-sonnet-5 上,一个 20,000-token 的系统提示词(system prompt)在未缓存的情况下,每 1,000 次请求的预估成本为 18.18 美元;若命中缓存,成本则约为 2.00 美元。
9月19日
每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新
TokenLab 博客

根据 TokenLab 在 2026-10-03 观察到的价格,在 claude-sonnet-5 上,一个 20,000-token 的系统提示词(system prompt)在未缓存的情况下,每 1,000 次请求的预估成本为 18.18 美元;若命中缓存,成本则约为 2.00 美元。

OpenRouter 与 TokenLab 的技术对比,深入分析跨 OpenAI、Anthropic 和 Gemini 端点的单一架构归一化与多格式原生网关路由。

从 OpenAI 迁移到 TokenLab,首先需要更改 `base_url` 和 `api_key`,然后根据过时的文档检查模型 ID、流式传输(streaming)、工具调用(tool calls)、错误格式(error shapes)、超时设置(timeouts)以及计费情况。

编码代理(coding agent)不应因模型名称的变更而崩溃。以下是 MCP 模型目录如何将模型选择转化为运行时查找的方法,包括请求示例、路由规则以及验证习惯。

一份来自 TokenLab 的过时四模型流式传输示例展示了为什么必须使用测试工具、日志记录头文件以及速率限制算法,分别对首个可见 token、总耗时和每秒 token 数进行测量。

因为模型字符串变动而遇到 404 错误,这对于启动 Agent 循环来说是一个糟糕的开始。以下是如何固定 `gemini-3.5-flash`、读取 Google Cloud 定价,并构建一个能够应对弃用问题的循环的方法。