Alibaba Cloud: qwen3.5-omni-flash-realtime

Precio, rendimiento, capacidades y una solicitud lista para usar con qwen3.5-omni-flash-realtime.
Comparar modelos
qwen3.5-omni-flash-realtime
DisponibleAlibaba CloudAudioSíncrono
Entrada / Salida
$3.97 / $15.74
Contexto
197K
Salida máxima
64K
Modalidades
AudioVisión
Capacidades
Uso de herramientas

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Tiempo realWebSocket
    WS/v1/realtime
    // npm install ws
    import WebSocket from 'ws';
    
    const socket = new WebSocket("wss://api.tokenlab.sh/v1/realtime?model=qwen3.5-omni-flash-realtime", {
      headers: { Authorization: "Bearer sk-xxx" }
    });
    
    socket.on('open', () => {
      // Send the input events supported by this model with socket.send(...).
      // https://docs.tokenlab.sh/api-reference/realtime/connect
    });
    socket.on('message', (data) => console.log(data.toString()));
    socket.on('error', (error) => console.error(error));
    socket.on('close', (code, reason) => console.log(code, reason.toString()));
    
    // Close the session when finished.
    process.on('SIGINT', () => socket.close());

Precios

El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.

Default

Por 1M Token
Precio Official
Entrada $3.97 / Salida $15.74 / Texto Entrada $0.4853 / Texto Salida $2.94
Precio de TokenLab
Entrada $3.97 / Salida $15.74 / Texto Entrada $0.4853 / Texto Salida $2.94
Descuento
-

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas

Aún no hay datos

Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre qwen3.5-omni-flash-realtime en Console con un prompt listo para editar o enviar.

Ayúdame a probar qwen3.5-omni-flash-realtime con una solicitud de audio breve en /v1/realtime. Muestra el resultado y el coste.

Casos de uso

Ideal para

Visión

Leer imágenes, parsear documentos y responder preguntas visuales

01

UX de voz

Prueba voz, transcripción o generación de audio.

02

Formatos de audio

Compara los requisitos de entrada de audio y los formatos de respuesta.

03

Comparación directa

Compara calidad, latencia y precio en una misma vista.

Ejemplos de prompts

Genera una narración de onboarding tranquila para una herramienta de devs.

Transcribe una llamada corta de cliente y extrae los action items.

Envía la solicitud más pequeña posible y muestra el resultado y el coste.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Cuánto cuesta qwen3.5-omni-flash-realtime?

En TokenLab, qwen3.5-omni-flash-realtime cuesta Entrada $3.97 / Salida $15.74 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Para qué es mejor qwen3.5-omni-flash-realtime?

qwen3.5-omni-flash-realtime admite Uso de herramientas, Visión, Búsqueda web. Puedes abrirlo directamente en Create.

¿Cómo pruebo qwen3.5-omni-flash-realtime?

Abre qwen3.5-omni-flash-realtime en Create para probar un ejemplo preparado para /v1/realtime.

¿Qué endpoint debe usar qwen3.5-omni-flash-realtime?

Utiliza https://api.tokenlab.sh/v1/realtime para qwen3.5-omni-flash-realtime. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Puedo probar qwen3.5-omni-flash-realtime antes de integrarlo?

Sí. Abrir Console inicia un borrador listo para qwen3.5-omni-flash-realtime y conserva tu prompt tras iniciar sesión, sin perder contexto.

¿Qué operaciones soporta qwen3.5-omni-flash-realtime?

qwen3.5-omni-flash-realtime admite Tiempo real. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Más de Qwen Omni

Modelos relacionados