Créez des applications nouvelle génération avec gpt-realtime-2.1
Tarification
Temps réel
Par 1M de tokens- Prix officiel
- Entrée $4.00 / Sortie $24.00 / Lecture cache $0.40
- Prix TokenLab
- Entrée $4.00 / Sortie $24.00 / Lecture cache $0.40
- Remise
- -
| Prix officielPar 1M de tokens | Prix TokenLabPar 1M de tokens | Remise | |
|---|---|---|---|
| Temps réel | Entrée $4.00 / Sortie $24.00 / Lecture cache $0.40 | Entrée $4.00 / Sortie $24.00 / Lecture cache $0.40 | - |
| Lecture cache | $0.40 | $0.40 | - |
Test en un clic
Après connexion, Web Agent conserve ce modèle, ce prompt et le préréglage de requête pour vous.
Tester gpt-realtime-2.1 dans Web Agent. Exécute une requête audio minimale à /v1/chat/completions, puis montre le corps de requête, la réponse et les notes d'intégration.
Atelier API
C’est la route par défaut pour la production. L’exemple de code ci-dessous utilise ce point de terminaison avec le format choisi.
curl https://api.tokenlab.sh/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxx" \
-d '{
"model": "gpt-realtime-2.1",
"messages": [
{"role": "user", "content": "Hello!"}
]
}'Cas d'usage
Idéal pourVision
Lire des images, parser des documents et répondre à des questions visuelles
UX vocale
Testez parole, transcription ou génération audio avant de les brancher dans une app.
Pipelines média
Voyez les exigences d'entrée et formats de réponse dont les pipelines audio en production ont vraiment besoin.
Comparaison directe
Comparez la qualité de réponse réelle, la latence et le prix pour les modèles par défaut en production.
Exemples de prompts
Génère une narration d'onboarding calme pour un outil développeur.
Transcris un court appel client et extrait les actions à mener.
Envoie la requête la plus simple possible et explique-moi chaque champ de la réponse.
Calculateur de coût
FAQ
Combien coûte gpt-realtime-2.1 ?
Sur TokenLab, gpt-realtime-2.1 coûte Entrée $4.00 / Sortie $24.00 Par 1M de tokens. La table tarifaire ci-dessus en montre le détail complet.
À quoi gpt-realtime-2.1 convient-il le mieux ?
gpt-realtime-2.1 est un bon choix pour Vision, Utilisation d'outils, Cache d'invites. Vous pouvez l'appeler via TokenLab avec une seule clé API.
Comment appeler l'API gpt-realtime-2.1 ?
Obtenez une clé API TokenLab, puis envoyez votre requête à https://api.tokenlab.sh/v1/chat/completions. La workbench API ci-dessus propose un endpoint recommandé et du code prêt à copier.
Quel endpoint gpt-realtime-2.1 doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/chat/completions par défaut pour gpt-realtime-2.1. Si un format natif fournisseur est pris en charge, la workbench API affiche aussi cet endpoint.
Puis-je tester gpt-realtime-2.1 avant de l'intégrer ?
Oui. « Tester dans Web Agent » ouvre un test prêt pour gpt-realtime-2.1 et conserve votre prompt après connexion, sans perdre le contexte.
Quelles opérations gpt-realtime-2.1 prend-il en charge ?
gpt-realtime-2.1 prend en charge Temps réel. Choisissez une opération dans la workbench API ci-dessus pour voir l'endpoint et l'exemple de code correspondants.