Construye aplicaciones de próxima generación con gpt-realtime-2.1-mini
Precios
Tiempo real
Por 1M tokens- Precio oficial
- Entrada $0.60 / Salida $2.40 / Lectura de caché $0.06
- Precio TokenLab
- Entrada $0.60 / Salida $2.40 / Lectura de caché $0.06
- Descuento
- -
| Precio oficialPor 1M tokens | Precio TokenLabPor 1M tokens | Descuento | |
|---|---|---|---|
| Tiempo real | Entrada $0.60 / Salida $2.40 / Lectura de caché $0.06 | Entrada $0.60 / Salida $2.40 / Lectura de caché $0.06 | - |
| Lectura de caché | $0.06 | $0.06 | - |
Prueba con un clic
Tras iniciar sesión, Web Agent conserva este modelo, el prompt y el preset de solicitud.
Probar gpt-realtime-2.1-mini en Web Agent. Ejecuta una petición de audio mínima en /v1/chat/completions, luego muestra el cuerpo, la respuesta y notas de integración.
Banco de API
Es la ruta predeterminada para producción. El ejemplo de código inferior usa este endpoint con el formato que elijas.
curl https://api.tokenlab.sh/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxx" \
-d '{
"model": "gpt-realtime-2.1-mini",
"messages": [
{"role": "user", "content": "Hello!"}
]
}'Casos de uso
Ideal paraVisión
Leer imágenes, parsear documentos y responder preguntas visuales
UX de voz
Prueba habla, transcripción o generación de audio antes de enchufarlo a una app.
Pipelines de medios
Mira los requisitos de entrada y formatos de respuesta que los pipelines de audio en producción realmente necesitan.
Comparación directa
Compara calidad de respuesta real, latencia y precio para modelos predeterminados de producción.
Ejemplos de prompts
Genera una narración de onboarding tranquila para una herramienta de devs.
Transcribe una llamada corta de cliente y extrae los action items.
Envía la petición más simple posible y explícame cada campo de la respuesta.
Calculadora de costo
Preguntas frecuentes
¿Cuánto cuesta gpt-realtime-2.1-mini?
En TokenLab, gpt-realtime-2.1-mini cuesta Entrada $0.60 / Salida $2.40 Por 1M tokens. La tabla de precios arriba muestra el desglose completo.
¿Para qué es mejor gpt-realtime-2.1-mini?
gpt-realtime-2.1-mini encaja bien con Visión, Uso de herramientas, Caché de Prompts. Puedes llamarlo a través de TokenLab con una sola API key.
¿Cómo llamo a la API de gpt-realtime-2.1-mini?
Obtén una API key de TokenLab y envía tu petición a https://api.tokenlab.sh/v1/chat/completions. La API workbench arriba ofrece un endpoint recomendado y código listo para copiar.
¿Qué endpoint debe usar gpt-realtime-2.1-mini?
Usa https://api.tokenlab.sh/v1/chat/completions por defecto para gpt-realtime-2.1-mini. Si el modelo soporta un formato nativo del proveedor, la API workbench también muestra ese endpoint.
¿Puedo probar gpt-realtime-2.1-mini antes de integrarlo?
Sí. «Probar en Web Agent» abre una prueba lista para gpt-realtime-2.1-mini y conserva tu prompt tras iniciar sesión, sin perder contexto.
¿Qué operaciones soporta gpt-realtime-2.1-mini?
gpt-realtime-2.1-mini soporta Tiempo real. Elige una operación en la API workbench arriba para ver el endpoint y el ejemplo de código correspondientes.