Alibaba Cloud: qwen3.5-omni-flash-realtime

Preis, Leistung, Fähigkeiten und eine sofort einsatzbereite Anfrage für qwen3.5-omni-flash-realtime.
Modelle vergleichen
qwen3.5-omni-flash-realtime
VerfügbarAlibaba CloudAudioSynchron
Eingabe / Ausgabe
$3.97 / $15.74
Kontext
197K
Maximale Ausgabe
64K
Modalitäten
AudioVision
Funktionen
Tool-Nutzung

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    EchtzeitWebSocket
    WS/v1/realtime
    // npm install ws
    import WebSocket from 'ws';
    
    const socket = new WebSocket("wss://api.tokenlab.sh/v1/realtime?model=qwen3.5-omni-flash-realtime", {
      headers: { Authorization: "Bearer sk-xxx" }
    });
    
    socket.on('open', () => {
      // Send the input events supported by this model with socket.send(...).
      // https://docs.tokenlab.sh/api-reference/realtime/connect
    });
    socket.on('message', (data) => console.log(data.toString()));
    socket.on('error', (error) => console.error(error));
    socket.on('close', (code, reason) => console.log(code, reason.toString()));
    
    // Close the session when finished.
    process.on('SIGINT', () => socket.close());

Preise

Der offizielle Preis ist die öffentliche Basisvorgabe des Modellerstellers. Der TokenLab-Preis ist das, was du für dieses Modell auf TokenLab zahlst.

Default

Pro 1M Token
Offizieller Preis
Eingabe $3.97 / Ausgabe $15.74 / Text Eingabe $0.4853 / Text Ausgabe $2.94
TokenLab-Preis
Eingabe $3.97 / Ausgabe $15.74 / Text Eingabe $0.4853 / Text Ausgabe $2.94
Rabatt
-

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden

Noch keine Daten

Modellleistung
Metriken erscheinen, sobald die Schwellenwerte für Datenschutz und Datenvolumen erreicht sind.

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne qwen3.5-omni-flash-realtime in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste qwen3.5-omni-flash-realtime mit einer kurzen Audio-Anfrage an /v1/realtime. Zeige Ergebnis und Kosten.

Anwendungsfälle

Geeignet für

Vision

Bilder lesen, Dokumente parsen und visuelle Fragen beantworten

01

Voice-UX

Teste Sprache, Transkription oder Audiogenerierung.

02

Audioformate

Vergleiche Audio-Eingabeanforderungen und Antwortformate.

03

Direkter Vergleich

Vergleiche Antwortqualität, Latenz und Preis direkt nebeneinander.

Prompt-Beispiele

Erzeuge eine ruhige Onboarding-Erzählung für ein Entwickler-Tool.

Transkribiere ein kurzes Kundengespräch und zieh die Action Items heraus.

Sende die kleinstmögliche Anfrage und zeige Ergebnis und Kosten.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Was kostet qwen3.5-omni-flash-realtime?

Auf TokenLab kostet qwen3.5-omni-flash-realtime Eingabe $3.97 / Ausgabe $15.74 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Wofür eignet sich qwen3.5-omni-flash-realtime am besten?

qwen3.5-omni-flash-realtime unterstützt Tool-Nutzung, Vision, Websuche. Öffne es direkt in Create.

Wie teste ich qwen3.5-omni-flash-realtime?

Öffnen Sie qwen3.5-omni-flash-realtime in Create. Dort können Sie ein Beispiel für /v1/realtime direkt ausprobieren.

Welchen Endpunkt soll qwen3.5-omni-flash-realtime verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/realtime für qwen3.5-omni-flash-realtime. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Kann ich qwen3.5-omni-flash-realtime vor der Integration testen?

Ja. Console öffnen startet einen vorbereiteten Entwurf für qwen3.5-omni-flash-realtime und behält Ihren Prompt nach der Anmeldung bei, sodass kein Kontext verloren geht.

Welche Operationen unterstützt qwen3.5-omni-flash-realtime?

qwen3.5-omni-flash-realtime unterstützt Echtzeit. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Mehr aus der Qwen Omni-Serie

Ähnliche Modelle