可用OpenAI音频同步⚡缓存 90% 优惠
gpt-realtime-2.1
构建基于 gpt-realtime-2.1 的下一代应用
价格
实时
每 1M Tokens- 官方价格
- 输入 $4.00 / 输出 $24.00 / 缓存读取 $0.40
- TokenLab 价格
- 输入 $4.00 / 输出 $24.00 / 缓存读取 $0.40
- 折扣
- -
| 官方价格每 1M Tokens | TokenLab 价格每 1M Tokens | 折扣 | |
|---|---|---|---|
| 实时 | 输入 $4.00 / 输出 $24.00 / 缓存读取 $0.40 | 输入 $4.00 / 输出 $24.00 / 缓存读取 $0.40 | - |
Prompt 缓存价格
| 缓存读取 | $0.40 | $0.40 | - |
一键测试
登录后,Web Agent 会保留这个模型、提示词和请求预设。
在 Web Agent 中测试 gpt-realtime-2.1。使用 /v1/chat/completions 运行最小音频请求,然后展示请求体、响应和接入注意事项。
API 工作台
生产默认路线。下方代码示例会按你选择的格式使用这个端点。
实时兼容 OpenAI
POST/v1/chat/completions
curl https://api.tokenlab.sh/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxx" \
-d '{
"model": "gpt-realtime-2.1",
"messages": [
{"role": "user", "content": "Hello!"}
]
}'应用场景
适合场景视觉
看图、解析文档与视觉问答
01
语音体验
在接入应用前测试语音、转写或音频生成流程。
02
媒体流水线
查看生产音频流程实际需要的输入要求和响应格式。
03
同台对比
比较生产默认模型所需的真实响应质量、延迟和价格。
提示词示例
为开发者工具生成一段平静的入门旁白。
转写一段客户通话,并提炼出待办事项。
发一个最简请求,把每个返回字段都讲清楚。
费用计算器
1M
0.5M
预估月度费用$16.00
常见问题
gpt-realtime-2.1 的费用是多少?
在 TokenLab 上,gpt-realtime-2.1 价格为 输入 $4.00 / 输出 $24.00 每 1M Tokens。完整明细见上方价格表。
gpt-realtime-2.1 适合做什么?
gpt-realtime-2.1 适合 视觉, 工具调用, 提示词缓存。可以通过 TokenLab 用同一个 API key 直接调用。
如何调用 gpt-realtime-2.1 API?
在 TokenLab 获取 API key 后,向 https://api.tokenlab.sh/v1/chat/completions 发请求即可。上方 API 工作台已提供推荐端点和可直接复制的代码示例。
gpt-realtime-2.1 应该使用哪个端点?
gpt-realtime-2.1 默认使用 https://api.tokenlab.sh/v1/chat/completions。如果模型支持原生格式,API 工作台会同时给出原生端点。
接入前可以先测试 gpt-realtime-2.1 吗?
可以。「在 Web Agent 中试用」会为 gpt-realtime-2.1 打开一个预填好的测试,登录后提示词不会丢,可以接着跑。
gpt-realtime-2.1 支持哪些操作?
gpt-realtime-2.1 支持 实时。在上方 API 工作台选具体操作,即可看到对应端点和代码示例。