可用OpenAI音频同步缓存 90% 优惠
gpt-realtime-2.1-mini

构建基于 gpt-realtime-2.1-mini 的下一代应用

API 代码示例

价格

实时

每 1M Tokens
官方价格
输入 $0.60 / 输出 $2.40 / 缓存读取 $0.06
TokenLab 价格
输入 $0.60 / 输出 $2.40 / 缓存读取 $0.06
折扣
-

一键测试

登录后,Web Agent 会保留这个模型、提示词和请求预设。

在 Web Agent 中测试 gpt-realtime-2.1-mini。使用 /v1/chat/completions 运行最小音频请求,然后展示请求体、响应和接入注意事项。

API 工作台

生产默认路线。下方代码示例会按你选择的格式使用这个端点。

实时兼容 OpenAI
POST/v1/chat/completions
curl https://api.tokenlab.sh/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-xxx" \
  -d '{
    "model": "gpt-realtime-2.1-mini",
    "messages": [
      {"role": "user", "content": "Hello!"}
    ]
  }'

应用场景

适合场景

视觉

看图、解析文档与视觉问答

01

语音体验

在接入应用前测试语音、转写或音频生成流程。

02

媒体流水线

查看生产音频流程实际需要的输入要求和响应格式。

03

同台对比

比较生产默认模型所需的真实响应质量、延迟和价格。

提示词示例

为开发者工具生成一段平静的入门旁白。

转写一段客户通话,并提炼出待办事项。

发一个最简请求,把每个返回字段都讲清楚。

费用计算器

1M
0.5M
预估月度费用$1.80

常见问题

gpt-realtime-2.1-mini 的费用是多少?

在 TokenLab 上,gpt-realtime-2.1-mini 价格为 输入 $0.60 / 输出 $2.40 每 1M Tokens。完整明细见上方价格表。

gpt-realtime-2.1-mini 适合做什么?

gpt-realtime-2.1-mini 适合 视觉, 工具调用, 提示词缓存。可以通过 TokenLab 用同一个 API key 直接调用。

如何调用 gpt-realtime-2.1-mini API?

在 TokenLab 获取 API key 后,向 https://api.tokenlab.sh/v1/chat/completions 发请求即可。上方 API 工作台已提供推荐端点和可直接复制的代码示例。

gpt-realtime-2.1-mini 应该使用哪个端点?

gpt-realtime-2.1-mini 默认使用 https://api.tokenlab.sh/v1/chat/completions。如果模型支持原生格式,API 工作台会同时给出原生端点。

接入前可以先测试 gpt-realtime-2.1-mini 吗?

可以。「在 Web Agent 中试用」会为 gpt-realtime-2.1-mini 打开一个预填好的测试,登录后提示词不会丢,可以接着跑。

gpt-realtime-2.1-mini 支持哪些操作?

gpt-realtime-2.1-mini 支持 实时。在上方 API 工作台选具体操作,即可看到对应端点和代码示例。

相关模型