Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

Journal des modifications

Nouveautés

Nouveaux modèles, tarifs et mises à jour produit, réunis ici. Consulter la documentation

2026 Q4

Modèles

Gemini Nano Banana 2.1 and Claude Haiku 5.5 are now available

Gemini Nano Banana 2.1 is Google's update to Nano Banana 2 for image generation and editing, with clearer text in images and steadier subjects across edits. Use gemini-nano-banana-2.1 (priced per token) or nano-banana-2.1 (priced per image) with the Images API at 1K, 2K or 4K in 14 aspect ratios. Claude Haiku 5.5 is the fastest model in the Claude 5 series, with text and image input, tool use, structured output, prompt caching, a 1M-token context window and up to 128K output tokens. Use claude-haiku-5-5 or its alias claude-haiku-5.5 with Chat Completions or Messages.

TokenLab Verified prices: Nano Banana 2.1 at 50% off the reference tariff, $0.0168, $0.0252 and $0.0565 per 1K, 2K and 4K image for nano-banana-2.1, and $0.75 input and $15 image output per million tokens for gemini-nano-banana-2.1. Claude Haiku 5.5 at 70% off: $0.03 input and $0.15 output per million tokens for prompts up to 100K tokens, and $0.15 and $0.75 above that, with the same discount on cache reads and writes. Official delivery is available at its listed price.

Modèles
gemini-nano-banana-2.1nano-banana-2.1claude-haiku-5-5
En vigueur
View models and pricing
Tarification

Les tarifs Verified de 15 modèles passent à 70 % du prix officiel

Pour 15 modèles GPT, de raisonnement et d’embedding, la remise Verified passe de 15 % à 30 %. Les prix unitaires passent de 85 % à 70 % du prix officiel, soit une baisse d’environ 17,65 %. La même remise couvre les composantes d’entrée, de sortie et de cache prises en charge.

Après l’entrée en vigueur, les nouvelles requêtes Verified utilisent les nouveaux tarifs. Aucun changement de nom de modèle ou d’appel API n’est nécessaire. Les tarifs Official et les frais historiques déjà réglés restent inchangés.

Modèles
gpt-4.1-minigpt-4ogpt-4o-minigpt-5gpt-5-minigpt-5-nanogpt-5.1gpt-5.2gpt-5.3-codexgpt-5.4gpt-5.4-minigpt-5.4-nanoo3text-embedding-3-largetext-embedding-3-small
En vigueur
Voir les modèles et les tarifs
Modèles

Catalogue actualisé des modèles image, vidéo et audio (3/3)

Cette liste de nouveautés comprend désormais 82 modèles distincts : 46 pour les images, 21 pour la vidéo, 6 pour l’audio, 4 pour la musique, 4 pour la 3D et 1 pour le Chat. Les opérations et variantes datées d’un même modèle ont été regroupées. Consultez les pages des modèles pour les paramètres et opérations disponibles.

Utilisez un identifiant commun et l’opération correspondante pour un même modèle. Les doublons et les anciennes versions exclues de cette sélection ont été retirés de la liste.

Modèles
riverflow-2-5-prorodin-gen-2runway-gen-4-5runway-gen-4-imagerunway-gen-4-image-turbosana-sprintskyreels-v4stable-audio-3-small-music-text-to-audiostable-audio-3-small-sfx-base-text-to-audiostable-audio-3-small-sfx-text-to-audiotopaz-labs-wonder-3-5trellis-2tripo-3d-v3-1uni-1uni-1-maxveed-fabric-1-0wan2-7-imagewan2-7-image-pro
En vigueur
Voir les modèles
Modèles

Catalogue actualisé des modèles image, vidéo et audio (2/3)

Cette liste de nouveautés comprend désormais 82 modèles distincts : 46 pour les images, 21 pour la vidéo, 6 pour l’audio, 4 pour la musique, 4 pour la 3D et 1 pour le Chat. Les opérations et variantes datées d’un même modèle ont été regroupées. Consultez les pages des modèles pour les paramètres et opérations disponibles.

Utilisez un identifiant commun et l’opération correspondante pour un même modèle. Les doublons et les anciennes versions exclues de cette sélection ont été retirés de la liste.

Modèles
krea-2-largekrea-2-mediumkrea-2-medium-turbokrea-2-rawkrea-2-turboltx-2-5-fastltx-2-5-promeshy-6minimax-h3-fastminimax-h3-max-turbominimax-speech-2-8mirelo-sfx-1-5muse-imageomnihuman-1-5p-imagep-image-editp-image-ideogramp-image-upscalep-video-2p-video-2-prop-video-avatarpicsart-image-vectorizerqwen-image-edit-2511qwen-image-layeredqwen3-tts-1-7b-customvoiceqwen3-tts-1-7b-voicedesignray3-2recraft-v4-stylesrecraft-v4-styles-prorecraft-v4-styles-pro-vectorrecraft-v4-styles-vectorriverflow-2-5-fast
En vigueur
Voir les modèles
Modèles

Catalogue actualisé des modèles image, vidéo et audio (1/3)

Cette liste de nouveautés comprend désormais 82 modèles distincts : 46 pour les images, 21 pour la vidéo, 6 pour l’audio, 4 pour la musique, 4 pour la 3D et 1 pour le Chat. Les opérations et variantes datées d’un même modèle ont été regroupées. Consultez les pages des modèles pour les paramètres et opérations disponibles.

Utilisez un identifiant commun et l’opération correspondante pour un même modèle. Les doublons et les anciennes versions exclues de cette sélection ont été retirés de la liste.

Modèles
boogu-image-0-1-editboogu-image-0-1-edit-turbobria-3-2bria-fibobria-fibo-editbria-fibo-litebria-image-increase-resolutionbria-rmbg-v2-0eleven-v4-turboernie-imageernie-image-turboflux-2-devflux-2-klein-4b-baseflux-2-klein-9b-baseflux-2-klein-9b-kvgoogle-gemma-4-31bheygen-video-1-0heygen-video-agentideogram-4-5imagineart-2-0inworld-realtime-tts-2juggernaut-zkling-image-3-0kling-image-o3kling-ttskling-video-3-0-4kkling-video-3-0-omni-4kkling-video-3-0-omni-prokling-video-3-0-omni-standardkling-video-3-0-prokling-video-3-0-standardkling-video-3-0-turbo
En vigueur
Voir les modèles

2026 Q3

Modèles

Nouveaux modèles d’image et de vidéo et retour de Speech 2.8 Turbo

Hy Image 3.5 Preview prend en charge la génération d’images en 1024×1024 à partir de texte et la modification d’images de référence. Hailuo H3-Max génère des vidéos de 5 à 15 secondes en 480p/768p à partir de texte, d’une première image ou d’une première et d’une dernière image. La synthèse vocale MiniMax Speech 2.8 Turbo est de nouveau disponible.

Modèles
hy-image-v3.5-previewhailuo-h3-maxspeech-2.8-turbo
En vigueur
Voir les modèles
Modèles

Nouveaux modèles de raisonnement, de recherche et de médias

Mistral Medium 3.5, Amazon Nova 2 Lite et Ember-1 rejoignent les complétions de chat. Voyage, Mistral et Perplexity ajoutent des embeddings de texte et de code. Recraft étend la génération d'images ; Cohere Rerank 4, Fish Transcribe-1, Grok TTS/STT et MiniMax H3 Max ajoutent des capacités de reranking, de parole et de vidéo.

Les nouveaux modèles sont disponibles dans OFFICIAL. Ember-1 est une version préliminaire de recherche. Vérifiez l'interface publiée, les limites et le prix de chaque modèle avant de changer.

Modèles
voyage-4-largevoyage-4voyage-4-litevoyage-3-largevoyage-3.5voyage-3.5-litevoyage-code-2voyage-code-3voyage-finance-2voyage-law-2mistral-embedcodestral-embedmistral-medium-3.5nova-2-liteember-1pplx-embed-v1-0.6bpplx-embed-v1-4brecraft-v3recraft-v4recraft-v4-prorecraft-v4.1recraft-v4.1-flashrecraft-v4.1-prorecraft-v4.1-utilityrecraft-v4.1-utility-prorerank-v4.0-fastrerank-v4.0-profish-transcribe-1grok-ttsgrok-sttminimax-h3-max
En vigueur
Explorer les modèles
Modèles

Veo 3.1 Lite est maintenant disponible

Utilisez veo3.1-lite via /v1/videos/generations pour générer des vidéos à partir de texte ou d’images. Les spécifications publiques initiales sont des vidéos de 8 secondes en 720p ou 1080p avec audio, en 16:9 ou 9:16. Consultez la poll_url renvoyée pour récupérer le résultat.

Modèles
veo3.1-lite
En vigueur
Voir le modèle
Modèles

Gemini Embedding 2 est maintenant disponible

Utilisez gemini-embedding-2 via /v1/embeddings pour générer des embeddings de texte. Une chaîne ou un lot de chaînes renvoie des vecteurs à virgule flottante ; les dimensions de sortie sont configurables.

Modèles
gemini-embedding-2
En vigueur
Voir le modèle
Modèles

GPT-6.1 Sol est maintenant disponible

Utilisez gpt-6.1-sol sur TokenLab avec Chat Completions et Responses. Le tarif standard par million de tokens est de $2 pour l’entrée, $0.10 pour l’entrée en cache, $2.50 pour les écritures du cache et $10 pour la sortie. Au-delà de 272K tokens d’entrée, les tarifs long contexte $4, $0.20, $5 et $15 s’appliquent.

Modèles
gpt-6.1-sol
En vigueur
Voir les modèles
Modèles

Claude Sonnet 5.5 is now available

Claude Sonnet 5.5 joins the Claude 5 series with text and image input, tool use, structured output, prompt caching, a 1M-token context window, and up to 128K output tokens. Use claude-sonnet-5-5 or its alias claude-sonnet-5.5 with Chat Completions, Responses, or Messages.

TokenLab Verified supports Chat Completions and Messages at 70% off the reference tariff: $0.60 input and $3.00 output per million tokens, with the same discount on cache reads and writes. Official delivery supports all three APIs at its listed price. Reasoning is enabled by default; thinking disabled and forced tool choice are not supported by this model.

Modèles
claude-sonnet-5-5
En vigueur
View model and pricing
Plateforme

Nouveau centre développeurs

Le nouveau centre développeurs regroupe SDK, outils et ressources d’intégration.

Voir le centre développeurs
Modèles

Nouveaux modèles de dialogue, de recherche et de médias

Modèles ajoutés : Qwen 3.8 Omni Flash, GLM 5.3 FlashX, Step 5 Preview, Hy4 Preview, Qwen 3.7 Text Embedding, Qwen 3.7 Text Embedding Flash, Qwen 3.7 Text Rerank, Doubao Seed 2.1 Lite, Seedream 5.0 Flash, Kimi K2.8 Preview, FLUX 3 Video, FLUX Video Edit, Stable Audio 3.0. Consultez le catalogue des modèles pour leurs capacités et tarifs actuels.

Modèles
qwen3.8-omni-flashglm-5.3-flashxstep-5-previewhy4-previewqwen3.7-text-embeddingqwen3.7-text-embedding-flashqwen3.7-text-rerankdoubao-seed-2.1-liteseedream-5.0-flashkimi-k2.8-previewflux-3-videoflux-video-editstable-audio-3
En vigueur
Voir les modèles
Modèles

Jev 1.13 est disponible pour les décisions typées

Utilisez jev-1.13 via POST /v1/systemone pour évaluer les probabilités Noul, les sélections Choice et les évaluations Score par rapport à l'état partagé. L'outil MCP TokenLab evaluate_decisions prend en charge la même requête native.

Conservez la structure des résultats de décision. Votre application contrôle la validation, les seuils de confiance, les autorisations et les actions.

Modèles
jev-1.13
En vigueur
Lire la référence de l'API System One
Tarification

Mises à jour de la tarification des images et des vidéos

Certains modèles d'image et de vidéo proposent désormais 5%–85% off avec TokenLab Verified ; consultez le catalogue pour chaque modèle. Wan 2.6 TokenLab Verified passe de $0.60 par requête à une tarification basée sur la durée : environ $0.08824/seconde à 720p et $0.14706/seconde à 1080p. Une vidéo de 5 secondes coûte environ $0.4412 ou $0.7353, respectivement. Gemini 3 Pro Image, Gemini 3.1 Flash Image et Gemini 3.1 Flash Lite Image facturent séparément les entrées et sorties de texte et d'image, avec TokenLab Verified restant à 50% off.

S'applique aux nouvelles requêtes. Le catalogue des modèles indique les tarifs exacts pour chaque paramètre ; les frais historiques restent inchangés.

Modèles
wan-2.6gemini-3-pro-imagegemini-3.1-flash-imagegemini-3.1-flash-lite-imagegrok-imagine-image-2.0grok-imagine-videogrok-imagine-video-1.5-previewhailuo-2.3-standardimage-background-removerimage-upscalerkling-v2.1-masterqwen-imageqwen-image-editz-image
En vigueur
Voir les prix et la disponibilité des modèles
Tarification

Augmentations de prix pour certains modèles

Pour TokenLab Verified, GPT-5.4 et GPT-5.4 mini passent de 70% off à 15% off ; Kling 3.0 passe de 30% off au prix officiel indiqué. HappyHorse 1.1 à 720p, 5 secondes, sans audio, augmente d'environ $0.4332 à $0.6188. À la qualité par défaut, Ideogram v3 passe de $0.04 à $0.06 par image ; Edit, Reframe et Remix v3 passent de $0.02 à $0.06 par image.

S'applique aux nouvelles requêtes TokenLab Verified. Les autres paramètres sont tarifés comme indiqué dans le catalogue des modèles ; les requêtes précédemment acceptées et les frais historiques restent inchangés.

Modèles
gpt-5.4gpt-5.4-minikling-v3.0happyhorse-1.1ideogram-v3ideogram-edit-v3ideogram-reframe-v3ideogram-remix-v3
En vigueur
Voir les prix et la disponibilité des modèles
Tarification

Mise à jour des remises sur les modèles de chat et d'embedding

Pour les modèles de cette mise à jour, TokenLab Verified propose 70% off Claude modèles et GPT-5.6 Luna ; 15% off les autres modèles GPT, o3 et text-embedding-3 ; et 50% off Grok 4.6 et 4.7. Les modèles concernés sont listés ci-dessous ; consultez le catalogue pour les prix individuels.

S'applique aux nouvelles requêtes TokenLab Verified. Les requêtes précédemment acceptées et les frais historiques restent inchangés.

Modèles
claude-fable-5claude-fable-5-1claude-haiku-4-5claude-opus-4-6claude-opus-4-7claude-opus-4-8claude-opus-5claude-opus-5-5claude-sonnet-4-6claude-sonnet-5gpt-5.6-lunagpt-4.1-minigpt-4ogpt-4o-minigpt-5gpt-5-minigpt-5-nanogpt-5.1gpt-5.2gpt-5.3-codexgpt-5.4-nanogrok-4.6grok-4.7o3text-embedding-3-largetext-embedding-3-small
En vigueur
Prix
15%–70% off
Voir les prix et la disponibilité des modèles
Modèles

Changements de disponibilité pour certains modèles

Seedance 1.5 Pro et Suno Lyrics n'acceptent plus de nouvelles requêtes. Seedance 2.0 Fast, Seedance 2.0 Mini et FLUX 2 Flex text-to-image sont disponibles via Auto ou Official ; FLUX l'édition d'image prend toujours en charge TokenLab Verified. Wan 2.6 continue de prendre en charge la conversion texte-vidéo et image-vidéo, mais ne prend plus en charge la conversion référence-vidéo.

Les clés restreintes à TokenLab Verified ne peuvent pas utiliser ces options Official uniquement. Les tâches précédemment acceptées et les enregistrements historiques restent disponibles.

Modèles
seedance-1.5-prosuno-lyricsseedance-2.0-fastseedance-2.0-miniwan-2.6flux-2-flex
En vigueur
Voir les prix et la disponibilité des modèles
Tarification

Mises à jour de la facturation du cache et du contexte long

Pour la livraison Official, la création de cache GLM-5, GLM-5.1 et GLM-5.2 utilise désormais le tarif d'entrée standard ; les lectures en cache conservent leur tarif réduit indiqué et les prix TokenLab Verified restent inchangés. Les tarifs pour contexte long s'appliquent à Grok 4.20 à partir de 200,000 jetons d'entrée ou plus et à Qwen 3.6 Max Preview au-dessus de 128,000 jetons d'entrée. Grok 4.20 TokenLab Verified reste 50% off le niveau applicable ; les prix Qwen TokenLab Verified restent inchangés.

S'applique aux nouvelles requêtes répondant à ces conditions. Consultez la tarification des modèles pour les tarifs ; les frais historiques restent inchangés.

Modèles
grok-4.20qwen3.6-max-previewglm-5glm-5.1glm-5.2
En vigueur
Voir les prix et la disponibilité des modèles
Tarification

Gemini 2.5 Flash et Flash Lite : 50% off

Gemini 2.5 Flash est disponible avec une tarification TokenLab Verified de $0.15 par million de jetons d'entrée et $1.25 par million de jetons de sortie. Gemini 2.5 Flash Lite est à $0.05 en entrée et $0.20 en sortie par million de jetons. Les deux sont 50% off aux prix officiels indiqués ; les prix des entrées en cache sont respectivement de $0.015 et $0.005 par million de jetons.

Modèles
gemini-2.5-flashgemini-2.5-flash-lite
En vigueur
Prix
50% off (TokenLab Verified)
Voir les prix des modèles
Modèles

GPT-6 Sol, GPT-6 Luna et Claude Opus 5.5 sont maintenant disponibles

Utilisez gpt-6-sol, gpt-6-luna et claude-opus-5-5 sur TokenLab. Consultez le catalogue des modèles pour connaître leurs capacités et prix actuels.

Modèles
gpt-6-solgpt-6-lunaclaude-opus-5-5
En vigueur
Parcourir les modèles
Plateforme

Chat dans la console : streaming, outils et recherche web

Le chat dans la console diffuse les réponses en streaming et peut utiliser des outils de fonction ainsi que la recherche web, les résultats des outils étant réinjectés dans la conversation. Définissez les outils de fonction dans l'éditeur JSON. Chaque réponse affiche son temps jusqu'au premier jeton.

Plateforme

Atelier média : modifications multi-images et première/dernière image vidéo

Modifiez une image à l'aide de plusieurs images de référence, ou définissez la première et la dernière image d'une vidéo. Chaque commande indique sa plage autorisée.

Ouvrir Console
Plateforme

Prévisualisez et téléchargez les résultats dans les détails de la tâche

Ouvrez une tâche pour prévisualiser et télécharger les fichiers multimédias et les modèles 3D qu'elle a générés.

Plateforme

Les requêtes ayant échoué indiquent la cause et le remboursement

Dans la console, les détails d'une requête ayant échoué indiquent ce qui n'a pas fonctionné et le montant exact remboursé. Seuls les membres de votre organisation peuvent les consulter.

Ouvrir Console
Plateforme

Recherchez des modèles, des pages et des documents au même endroit

Trouvez des modèles, des pages de site et de la documentation à partir d'une seule zone de recherche. Vous pouvez également limiter la recherche à Console ou au site public.

Voir la documentation
Plateforme

Informations de rétention plus claires pour les médias téléchargés

Les images privées téléchargées en tant qu'entrées de tâche sont supprimées lorsque la période de rétention de la tâche prend fin. L'atelier multimédia explique combien de temps les pièces jointes temporaires restent disponibles.

Ouvrir Console
Plateforme

Guides de configuration de l'assistant IA sur le tableau de bord

La vue d'ensemble du tableau de bord inclut désormais des guides de configuration pour l'assistant IA, avec des tutoriels pour Cursor et DeepSeek Harness.

Ouvrir Console
Tarification

Montants de remboursement et unités de tarification plus clairs dans la facturation

Les requêtes échouées ou ajustées indiquent les montants de remboursement exacts. Les détails de facturation distinguent les types de frais, les unités de tarification, les frais nuls et les tarifs de cache afin que vous puissiez vérifier chaque frais, remboursement et tarif applicable.

Plateforme

Site web TokenLab 2.0 et Console

Le site web TokenLab 2.0 et Console regroupent la sélection de modèles, les clés API, l'utilisation et la facturation dans un seul espace de travail.

Les clients existants n'ont besoin d'effectuer aucun changement.

Ouvrir Console
Modèles

DeepSeek V4.1 Flash est disponible

DeepSeek V4.1 Flash est désormais disponible dans le catalogue en tant que deepseek-v4.1-flash. Les requêtes existantes utilisant deepseek-flash continuent de fonctionner.

Modèles
deepseek-v4.1-flash
En vigueur
Voir les modèles
Modèles

Les modèles GPT Image 2.5 Sunburst et Flare sont disponibles

GPT Image 2.5 Sunburst et Flare figurent désormais au catalogue, avec la génération et l'édition d'images via les TokenLab Images API.

Modèles
gpt-image-2.5-sunburstgpt-image-2.5-flare
En vigueur
Voir les modèles
Plateforme

Consultez les tarifs des images avant de générer

Pour les images facturées à l'usage, l'atelier multimédia affiche le taux de jetons de sortie et le montant minimum retenu avant la génération. Vous payez pour l'utilisation réelle, et la page vous indique quand le total ne peut pas être connu à l'avance.

Ouvrir Console
Modèles

Gemini 3.8 Flash et GPT 6 Astra ajoutés

Gemini 3.8 Flash et GPT 6 Astra sont désormais disponibles dans le catalogue de modèles TokenLab.

Modèles
gemini-3.8-flashgpt-6-astra
En vigueur
Parcourir les modèles
Plateforme

Le catalogue affiche les développeurs de modèles et le statut du cycle de vie

Le catalogue de modèles affiche le développeur et le statut du cycle de vie de chaque modèle, afin que vous puissiez l'examiner avant l'intégration.

Plateforme

Choisissez un mode de livraison pour chaque demande

Auto, TokenLab Verified et Official affichent chacun leur prix correspondant. Définissez une valeur par défaut pour l'espace de travail ou choisissez un mode de livraison par demande avec l'en-tête X-TokenLab-Delivery-Policy. Si le mode sélectionné n'est pas disponible, le API renvoie delivery_tier_unavailable. Les enregistrements de demande indiquent les modes de livraison demandés et résolus.

Ouvrir dans Console
Tarification

Les requêtes qui échouent avant leur exécution sont remboursées

Si une requête échoue avant d'être envoyée pour traitement et que son résultat ne peut être confirmé, les frais sont automatiquement remboursés.

Plateforme

Répartition de l'utilisation et des coûts dans le tableau de bord

Consultez l'utilisation et les coûts par clé API, par modèle et par plage de dates pour comprendre vos dépenses sans avoir à exporter au préalable des enregistrements bruts.

Plateforme

Comparer les modèles dans une vue de catalogue unique

Le catalogue de modèles combine l'utilisation hebdomadaire, les classements de tâches et les prix unitaires dans une seule vue.

Parcourir les modèles
API

Les requêtes vidéo prennent en charge les références d'éléments ainsi que la première et la dernière image

Utilisez des références d'éléments pour maintenir la cohérence d'un sujet tout au long d'une vidéo, et définissez la première et la dernière image du clip. Les paramètres pris en charge varient selon le modèle ; consultez la référence de l'API du modèle.

API

Exécuter des tâches d'image en arrière-plan

Soumettez une génération ou une modification d'image en tant que tâche d'arrière-plan et obtenez un identifiant de tâche. Interrogez son statut ou recevez un webhook lorsqu'elle est terminée. La tâche signale sa progression et son coût final, évitant ainsi de maintenir une connexion ouverte pendant un rendu long.

Utilisez une tâche d'arrière-plan lorsqu'un rendu risque de dépasser le délai d'attente de votre client.

Modèles

GLM 5.3, Grok 4.6 et Gemini 3.7 Flash ajoutés

GLM 5.3, Grok 4.6 et Gemini 3.7 Flash sont désormais disponibles dans le catalogue de modèles TokenLab.

Modèles
glm-5.3grok-4.6gemini-3.7-flash
En vigueur
Parcourir les modèles
API

Les erreurs de limitation de débit indiquent quand réessayer

Une réponse 429 inclut un en-tête Retry-After, permettant à votre client d'attendre la durée appropriée avant de réessayer.

API

Serveur MCP TokenLab pour les agents de codage

Les agents de codage peuvent rechercher des identifiants de modèles, des tarifs et des détails d'API via le serveur MCP TokenLab avant d'écrire du code d'intégration. Ces recherches n'appellent pas de modèle et ne sont donc pas facturées.

API

API de réponses via WebSocket

Si votre client ne peut pas maintenir un flux d'événements envoyés par le serveur (SSE) ouvert, créez et poursuivez les appels de l'API de réponses via WebSocket à la place.

API

API de synthèse vocale, de transcription et de traduction

Générez de la parole à partir de texte, transcrivez de l'audio et traduisez de l'audio avec la même clé API et le même solde que ceux utilisés pour les modèles de texte.

API

La liste des modèles inclut les capacités

L'API des modèles renvoie les capacités de chaque modèle, permettant aux outils et aux agents de vérifier quels modèles ils peuvent appeler et ce que chacun prend en charge sans avoir à lire la documentation.

API

Actifs de référence Seedance réutilisables

Importez des images et des vidéos de référence une seule fois en tant qu'actifs Seedance, validez-les et réutilisez-les dans vos requêtes vidéo. Gérez-les via l'API ou sur la page des actifs Seedance dans la console.

2026 Q2

API

API de génération 3D

Créez des modèles 3D via l'API. Chaque tâche renvoie un identifiant : vérifiez son statut, puis téléchargez les fichiers de résultat une fois terminée.

API

Exportation d'utilisation et API de gestion

Exportez les enregistrements d'utilisation depuis la console, ou consultez l'utilisation et la facturation pour chaque clé API via l'API de gestion. Utilisez ces données pour le rapprochement et vos tableaux de bord internes.

API

Migration et compatibilité de l'URL de base API

L'URL de base API a été déplacée vers https://api.tokenlab.sh.. L'adresse précédente, https://api.lemondata.cc,, est restée disponible pendant la période de compatibilité annoncée se terminant le 1 juillet 2026.

Utilisez https://api.tokenlab.sh pour les nouvelles intégrations.

Tarification

Les frais de streaming correspondent à l'utilisation signalée

Pour le chat en streaming, vous êtes facturé selon l'utilisation finale renvoyée par l'API, afin que vos relevés d'utilisation et vos frais concordent.

2026 Q1

API

API d'embeddings et de rerank

Appelez les modèles d'embedding et de rerank avec la même clé API et le même solde que pour le chat. Les erreurs utilisent le même format que les autres points de terminaison.

API

Webhooks pour les tâches asynchrones

Recevez un webhook lorsqu'une tâche asynchrone est terminée, échoue ou expire, au lieu d'interroger son statut.

Tarification

Les tâches asynchrones ayant échoué sont remboursées automatiquement

Si une tâche asynchrone échoue, les frais sont automatiquement recrédités sur votre solde.

Tarification

Les jetons d'entrée mis en cache sont facturés au tarif du cache

Pour les modèles pris en charge, les jetons d'entrée mis en cache sont désormais inclus dans la facturation finale au tarif du cache au lieu du tarif d'entrée standard.

Corrections et améliorations11
  • Les exportations d'utilisation correspondent aux enregistrements filtrés du tableau de bord

    Correction des requêtes et des exportations d'utilisation pour les longues plages de dates et les vues filtrées, afin que les enregistrements exportés correspondent à ceux affichés dans le tableau de bord.

  • Les modifications d'image conservent l'ordre des images d'entrée

    Les modifications d'image impliquant plusieurs images d'entrée les utilisent dans l'ordre où vous les avez envoyées. Si une requête dépasse le délai d'attente de votre client, vous pouvez toujours obtenir le résultat à partir de l'enregistrement de la tâche.

  • La facturation affiche les petits frais et remboursements

    Les petits frais et remboursements ne sont plus arrondis à zéro dans les vues de facturation, ce qui vous permet de voir les coûts par requête inférieurs à un centime.

  • Les réponses de transcription et de parole synchrone correspondent à la documentation

    Correction des formats de réponse pour les points de terminaison de transcription et de parole synchrone afin que les champs et structures renvoyés correspondent à la documentation.

  • Les réponses sont marquées correctement lorsqu'elles atteignent la limite de longueur

    Les réponses qui atteignent la limite de longueur portent désormais le marqueur de troncature correct. L'interface indique que la sortie est incomplète.

  • Les webhooks de tâche effectuent une nouvelle tentative après des échecs de livraison

    Les webhooks de fin de tâche sont relancés après un échec de livraison, afin que les notifications ne dépendent pas d'une seule tentative.

  • Les requêtes vidéo sans prix publié sont rejetées

    Une requête vidéo est rejetée immédiatement lorsque la combinaison de sa taille et de son mode ne possède aucun tarif publié, évitant ainsi toute acceptation à un prix indéfini. La référence à une vidéo utilise les mêmes tarifs publiés que le reste du catalogue vidéo.

  • Les requêtes textuelles vers les modèles de vision fonctionnent normalement

    Une requête contenant uniquement du texte, envoyée à un modèle qui accepte également des images, renvoie désormais une réponse textuelle normale au lieu d'une erreur.

  • Les limitations de débit temporaires sont réessayées automatiquement

    Lorsqu'une requête atteint une limite de débit courte et qu'un nouvel essai est sans risque, TokenLab réessaie automatiquement pour vous, réduisant ainsi le nombre d'échecs de requêtes.

  • Un format d'erreur unique pour tous les modèles

    Les erreurs de chaque modèle utilisent le même format de réponse et des types d'erreurs stables, vous permettant de gérer les échecs de manière centralisée.

  • Les requêtes d'images trop volumineuses sont désormais rejetées immédiatement

    Les requêtes de téléchargement d'images dépassant la taille prise en charge sont rejetées avant tout traitement. Les clients reçoivent immédiatement une erreur claire et la requête ne consomme aucun crédit d'utilisation.

Testez par vous-même

Essayez les dernières nouveautés dans le catalogue de modèles, ou consultez la doc avant de mettre à jour une intégration.