Alibaba Cloud: qwen3.5-omni-flash-realtime

Prix, performances, capacités et requête prête à l'emploi pour qwen3.5-omni-flash-realtime.
Comparer les modèles
qwen3.5-omni-flash-realtime
DisponibleAlibaba CloudAudioSynchrone
Entrée / Sortie
$3.97 / $15.74
Contexte
197K
Sortie maximale
64K
Modalités
AudioVision
Capacités
Utilisation d'outils

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Temps réelWebSocket
    WS/v1/realtime
    // npm install ws
    import WebSocket from 'ws';
    
    const socket = new WebSocket("wss://api.tokenlab.sh/v1/realtime?model=qwen3.5-omni-flash-realtime", {
      headers: { Authorization: "Bearer sk-xxx" }
    });
    
    socket.on('open', () => {
      // Send the input events supported by this model with socket.send(...).
      // https://docs.tokenlab.sh/api-reference/realtime/connect
    });
    socket.on('message', (data) => console.log(data.toString()));
    socket.on('error', (error) => console.error(error));
    socket.on('close', (code, reason) => console.log(code, reason.toString()));
    
    // Close the session when finished.
    process.on('SIGINT', () => socket.close());

Tarification

Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.

Default

Par 1M Token
Tarif Official
Entrée $3.97 / Sortie $15.74 / Texte Entrée $0.4853 / Texte Sortie $2.94
Prix TokenLab
Entrée $3.97 / Sortie $15.74 / Texte Entrée $0.4853 / Texte Sortie $2.94
Remise
-

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures

Pas encore de données

Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez qwen3.5-omni-flash-realtime dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester qwen3.5-omni-flash-realtime avec une requête audio sur /v1/realtime. Affiche le résultat et le coût.

Cas d'usage

Idéal pour

Vision

Lire des images, parser des documents et répondre à des questions visuelles

01

UX vocale

Testez la parole, la transcription ou la génération audio.

02

Formats audio

Comparez les exigences d'entrée audio et les formats de réponse.

03

Comparaison directe

Comparez qualité, latence et prix en un coup d'œil.

Exemples de prompts

Génère une narration d'onboarding calme pour un outil développeur.

Transcris un court appel client et extrait les actions à mener.

Envoie la requête la plus légère possible et affiche le résultat et le coût.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Combien coûte qwen3.5-omni-flash-realtime ?

Sur TokenLab, qwen3.5-omni-flash-realtime coûte Entrée $3.97 / Sortie $15.74 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

À quoi qwen3.5-omni-flash-realtime convient-il le mieux ?

qwen3.5-omni-flash-realtime prend en charge Utilisation d'outils, Vision, Recherche web. Ouvrez-le directement dans Create.

Comment tester qwen3.5-omni-flash-realtime ?

Ouvrez qwen3.5-omni-flash-realtime dans Create pour essayer un exemple prêt pour /v1/realtime.

Quel endpoint qwen3.5-omni-flash-realtime doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/realtime pour qwen3.5-omni-flash-realtime. L'exemple de requête ci-dessous montre la structure de code correspondante.

Puis-je tester qwen3.5-omni-flash-realtime avant de l'intégrer ?

Oui. Ouvrir Console lance un brouillon prêt pour qwen3.5-omni-flash-realtime et conserve votre prompt après connexion, sans perdre le contexte.

Quelles opérations qwen3.5-omni-flash-realtime prend-il en charge ?

qwen3.5-omni-flash-realtime prend en charge Temps réel. Sélectionnez une opération pour voir l'endpoint et un exemple.

Plus de la série Qwen Omni

Modèles associés