OpenAI: gpt-realtime-2

Precio, rendimiento, capacidades y una solicitud lista para usar con gpt-realtime-2.
Comparar modelos
gpt-realtime-2
DisponibleOpenAIAudioSíncronoEntrada en caché 90% más barata
Entrada / Salida
$4.00 / $24.00
Contexto
32K
Salida máxima
4K
Modalidades
Audio
Capacidades
Uso de herramientasCaché de prompts

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Tiempo realWebSocket
    WS/v1/realtime
    // npm install ws
    import WebSocket from 'ws';
    
    const socket = new WebSocket("wss://api.tokenlab.sh/v1/realtime?model=gpt-realtime-2", {
      headers: { Authorization: "Bearer sk-xxx" }
    });
    
    socket.on('open', () => {
      // Send the input events supported by this model with socket.send(...).
      // https://docs.tokenlab.sh/api-reference/realtime/connect
    });
    socket.on('message', (data) => console.log(data.toString()));
    socket.on('error', (error) => console.error(error));
    socket.on('close', (code, reason) => console.log(code, reason.toString()));
    
    // Close the session when finished.
    process.on('SIGINT', () => socket.close());

Precios

El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.

Tiempo real

Por 1M Token
Precio Official
Entrada $4.00 / Salida $24.00 / Lectura de caché $0.40 / Texto Entrada $4.00 / Texto Entrada · Lectura de caché $0.40 / Audio Entrada $32.00 / Audio Entrada · Lectura de caché $0.40 / Imagen Entrada $5.00 / Imagen Entrada · Lectura de caché $0.50 / Texto Salida $24.00 / Audio Salida $64.00
Precio de TokenLab
Entrada $4.00 / Salida $24.00 / Lectura de caché $0.40 / Texto Entrada $4.00 / Texto Entrada · Lectura de caché $0.40 / Audio Entrada $32.00 / Audio Entrada · Lectura de caché $0.40 / Imagen Entrada $5.00 / Imagen Entrada · Lectura de caché $0.50 / Texto Salida $24.00 / Audio Salida $64.00
Descuento
-
Precios de caché de prompt

Lectura de caché

Precio Official
$0.40
Precio de TokenLab
$0.40
Descuento
-

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas

Aún no hay datos

Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre gpt-realtime-2 en Console con un prompt listo para editar o enviar.

Ayúdame a probar gpt-realtime-2 con una solicitud de audio breve en /v1/realtime. Muestra el resultado y el coste.

Casos de uso

01

UX de voz

Prueba voz, transcripción o generación de audio.

02

Formatos de audio

Compara los requisitos de entrada de audio y los formatos de respuesta.

03

Comparación directa

Compara calidad, latencia y precio en una misma vista.

Ejemplos de prompts

Genera una narración de onboarding tranquila para una herramienta de devs.

Transcribe una llamada corta de cliente y extrae los action items.

Envía la solicitud más pequeña posible y muestra el resultado y el coste.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Cuánto cuesta gpt-realtime-2?

En TokenLab, gpt-realtime-2 cuesta Entrada $4.00 / Salida $24.00 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Para qué es mejor gpt-realtime-2?

gpt-realtime-2 admite Caché de prompts, Uso de herramientas. Puedes abrirlo directamente en Create.

¿Cómo pruebo gpt-realtime-2?

Abre gpt-realtime-2 en Create para probar un ejemplo preparado para /v1/realtime.

¿Qué endpoint debe usar gpt-realtime-2?

Utiliza https://api.tokenlab.sh/v1/realtime para gpt-realtime-2. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Puedo probar gpt-realtime-2 antes de integrarlo?

Sí. Abrir Console inicia un borrador listo para gpt-realtime-2 y conserva tu prompt tras iniciar sesión, sin perder contexto.

¿Qué operaciones soporta gpt-realtime-2?

gpt-realtime-2 admite Tiempo real. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Más de GPT Audio

Modelos relacionados