Gemini Nano Banana 2.1 and Claude Haiku 5.5 are now available
Gemini Nano Banana 2.1 is Google's update to Nano Banana 2 for image generation and editing, with clearer text in images and steadier subjects across edits. Use gemini-nano-banana-2.1 (priced per token) or nano-banana-2.1 (priced per image) with the Images API at 1K, 2K or 4K in 14 aspect ratios. Claude Haiku 5.5 is the fastest model in the Claude 5 series, with text and image input, tool use, structured output, prompt caching, a 1M-token context window and up to 128K output tokens. Use claude-haiku-5-5 or its alias claude-haiku-5.5 with Chat Completions or Messages.
TokenLab Verified prices: Nano Banana 2.1 at 50% off the reference tariff, $0.0168, $0.0252 and $0.0565 per 1K, 2K and 4K image for nano-banana-2.1, and $0.75 input and $15 image output per million tokens for gemini-nano-banana-2.1. Claude Haiku 5.5 at 70% off: $0.03 input and $0.15 output per million tokens for prompts up to 100K tokens, and $0.15 and $0.75 above that, with the same discount on cache reads and writes. Official delivery is available at its listed price.
Les tarifs Verified de 15 modèles passent à 70 % du prix officiel
Pour 15 modèles GPT, de raisonnement et d’embedding, la remise Verified passe de 15 % à 30 %. Les prix unitaires passent de 85 % à 70 % du prix officiel, soit une baisse d’environ 17,65 %. La même remise couvre les composantes d’entrée, de sortie et de cache prises en charge.
Après l’entrée en vigueur, les nouvelles requêtes Verified utilisent les nouveaux tarifs. Aucun changement de nom de modèle ou d’appel API n’est nécessaire. Les tarifs Official et les frais historiques déjà réglés restent inchangés.
Catalogue actualisé des modèles image, vidéo et audio (3/3)
Cette liste de nouveautés comprend désormais 82 modèles distincts : 46 pour les images, 21 pour la vidéo, 6 pour l’audio, 4 pour la musique, 4 pour la 3D et 1 pour le Chat. Les opérations et variantes datées d’un même modèle ont été regroupées. Consultez les pages des modèles pour les paramètres et opérations disponibles.
Utilisez un identifiant commun et l’opération correspondante pour un même modèle. Les doublons et les anciennes versions exclues de cette sélection ont été retirés de la liste.
Catalogue actualisé des modèles image, vidéo et audio (2/3)
Cette liste de nouveautés comprend désormais 82 modèles distincts : 46 pour les images, 21 pour la vidéo, 6 pour l’audio, 4 pour la musique, 4 pour la 3D et 1 pour le Chat. Les opérations et variantes datées d’un même modèle ont été regroupées. Consultez les pages des modèles pour les paramètres et opérations disponibles.
Utilisez un identifiant commun et l’opération correspondante pour un même modèle. Les doublons et les anciennes versions exclues de cette sélection ont été retirés de la liste.
Catalogue actualisé des modèles image, vidéo et audio (1/3)
Cette liste de nouveautés comprend désormais 82 modèles distincts : 46 pour les images, 21 pour la vidéo, 6 pour l’audio, 4 pour la musique, 4 pour la 3D et 1 pour le Chat. Les opérations et variantes datées d’un même modèle ont été regroupées. Consultez les pages des modèles pour les paramètres et opérations disponibles.
Utilisez un identifiant commun et l’opération correspondante pour un même modèle. Les doublons et les anciennes versions exclues de cette sélection ont été retirés de la liste.
Nouveaux modèles d’image et de vidéo et retour de Speech 2.8 Turbo
Hy Image 3.5 Preview prend en charge la génération d’images en 1024×1024 à partir de texte et la modification d’images de référence. Hailuo H3-Max génère des vidéos de 5 à 15 secondes en 480p/768p à partir de texte, d’une première image ou d’une première et d’une dernière image. La synthèse vocale MiniMax Speech 2.8 Turbo est de nouveau disponible.
Nouveaux modèles de raisonnement, de recherche et de médias
Mistral Medium 3.5, Amazon Nova 2 Lite et Ember-1 rejoignent les complétions de chat. Voyage, Mistral et Perplexity ajoutent des embeddings de texte et de code. Recraft étend la génération d'images ; Cohere Rerank 4, Fish Transcribe-1, Grok TTS/STT et MiniMax H3 Max ajoutent des capacités de reranking, de parole et de vidéo.
Les nouveaux modèles sont disponibles dans OFFICIAL. Ember-1 est une version préliminaire de recherche. Vérifiez l'interface publiée, les limites et le prix de chaque modèle avant de changer.
Utilisez veo3.1-lite via /v1/videos/generations pour générer des vidéos à partir de texte ou d’images. Les spécifications publiques initiales sont des vidéos de 8 secondes en 720p ou 1080p avec audio, en 16:9 ou 9:16. Consultez la poll_url renvoyée pour récupérer le résultat.
Utilisez gemini-embedding-2 via /v1/embeddings pour générer des embeddings de texte. Une chaîne ou un lot de chaînes renvoie des vecteurs à virgule flottante ; les dimensions de sortie sont configurables.
Utilisez gpt-6.1-sol sur TokenLab avec Chat Completions et Responses. Le tarif standard par million de tokens est de $2 pour l’entrée, $0.10 pour l’entrée en cache, $2.50 pour les écritures du cache et $10 pour la sortie. Au-delà de 272K tokens d’entrée, les tarifs long contexte $4, $0.20, $5 et $15 s’appliquent.
Claude Sonnet 5.5 joins the Claude 5 series with text and image input, tool use, structured output, prompt caching, a 1M-token context window, and up to 128K output tokens. Use claude-sonnet-5-5 or its alias claude-sonnet-5.5 with Chat Completions, Responses, or Messages.
TokenLab Verified supports Chat Completions and Messages at 70% off the reference tariff: $0.60 input and $3.00 output per million tokens, with the same discount on cache reads and writes. Official delivery supports all three APIs at its listed price. Reasoning is enabled by default; thinking disabled and forced tool choice are not supported by this model.
Utilisez jev-1.13 via POST /v1/systemone pour évaluer les probabilités Noul, les sélections Choice et les évaluations Score par rapport à l'état partagé. L'outil MCP TokenLab evaluate_decisions prend en charge la même requête native.
Conservez la structure des résultats de décision. Votre application contrôle la validation, les seuils de confiance, les autorisations et les actions.
Mises à jour de la tarification des images et des vidéos
Certains modèles d'image et de vidéo proposent désormais 5%–85% off avec TokenLab Verified ; consultez le catalogue pour chaque modèle. Wan 2.6 TokenLab Verified passe de $0.60 par requête à une tarification basée sur la durée : environ $0.08824/seconde à 720p et $0.14706/seconde à 1080p. Une vidéo de 5 secondes coûte environ $0.4412 ou $0.7353, respectivement. Gemini 3 Pro Image, Gemini 3.1 Flash Image et Gemini 3.1 Flash Lite Image facturent séparément les entrées et sorties de texte et d'image, avec TokenLab Verified restant à 50% off.
S'applique aux nouvelles requêtes. Le catalogue des modèles indique les tarifs exacts pour chaque paramètre ; les frais historiques restent inchangés.
Pour TokenLab Verified, GPT-5.4 et GPT-5.4 mini passent de 70% off à 15% off ; Kling 3.0 passe de 30% off au prix officiel indiqué. HappyHorse 1.1 à 720p, 5 secondes, sans audio, augmente d'environ $0.4332 à $0.6188. À la qualité par défaut, Ideogram v3 passe de $0.04 à $0.06 par image ; Edit, Reframe et Remix v3 passent de $0.02 à $0.06 par image.
S'applique aux nouvelles requêtes TokenLab Verified. Les autres paramètres sont tarifés comme indiqué dans le catalogue des modèles ; les requêtes précédemment acceptées et les frais historiques restent inchangés.
Mise à jour des remises sur les modèles de chat et d'embedding
Pour les modèles de cette mise à jour, TokenLab Verified propose 70% off Claude modèles et GPT-5.6 Luna ; 15% off les autres modèles GPT, o3 et text-embedding-3 ; et 50% off Grok 4.6 et 4.7. Les modèles concernés sont listés ci-dessous ; consultez le catalogue pour les prix individuels.
S'applique aux nouvelles requêtes TokenLab Verified. Les requêtes précédemment acceptées et les frais historiques restent inchangés.
Changements de disponibilité pour certains modèles
Seedance 1.5 Pro et Suno Lyrics n'acceptent plus de nouvelles requêtes. Seedance 2.0 Fast, Seedance 2.0 Mini et FLUX 2 Flex text-to-image sont disponibles via Auto ou Official ; FLUX l'édition d'image prend toujours en charge TokenLab Verified. Wan 2.6 continue de prendre en charge la conversion texte-vidéo et image-vidéo, mais ne prend plus en charge la conversion référence-vidéo.
Les clés restreintes à TokenLab Verified ne peuvent pas utiliser ces options Official uniquement. Les tâches précédemment acceptées et les enregistrements historiques restent disponibles.
Mises à jour de la facturation du cache et du contexte long
Pour la livraison Official, la création de cache GLM-5, GLM-5.1 et GLM-5.2 utilise désormais le tarif d'entrée standard ; les lectures en cache conservent leur tarif réduit indiqué et les prix TokenLab Verified restent inchangés. Les tarifs pour contexte long s'appliquent à Grok 4.20 à partir de 200,000 jetons d'entrée ou plus et à Qwen 3.6 Max Preview au-dessus de 128,000 jetons d'entrée. Grok 4.20 TokenLab Verified reste 50% off le niveau applicable ; les prix Qwen TokenLab Verified restent inchangés.
S'applique aux nouvelles requêtes répondant à ces conditions. Consultez la tarification des modèles pour les tarifs ; les frais historiques restent inchangés.
Gemini 2.5 Flash est disponible avec une tarification TokenLab Verified de $0.15 par million de jetons d'entrée et $1.25 par million de jetons de sortie. Gemini 2.5 Flash Lite est à $0.05 en entrée et $0.20 en sortie par million de jetons. Les deux sont 50% off aux prix officiels indiqués ; les prix des entrées en cache sont respectivement de $0.015 et $0.005 par million de jetons.
Chat dans la console : streaming, outils et recherche web
Le chat dans la console diffuse les réponses en streaming et peut utiliser des outils de fonction ainsi que la recherche web, les résultats des outils étant réinjectés dans la conversation. Définissez les outils de fonction dans l'éditeur JSON. Chaque réponse affiche son temps jusqu'au premier jeton.
Plateforme
Atelier média : modifications multi-images et première/dernière image vidéo
Modifiez une image à l'aide de plusieurs images de référence, ou définissez la première et la dernière image d'une vidéo. Chaque commande indique sa plage autorisée.
Prévisualisez et téléchargez les résultats dans les détails de la tâche
Ouvrez une tâche pour prévisualiser et télécharger les fichiers multimédias et les modèles 3D qu'elle a générés.
Plateforme
Les requêtes ayant échoué indiquent la cause et le remboursement
Dans la console, les détails d'une requête ayant échoué indiquent ce qui n'a pas fonctionné et le montant exact remboursé. Seuls les membres de votre organisation peuvent les consulter.
Recherchez des modèles, des pages et des documents au même endroit
Trouvez des modèles, des pages de site et de la documentation à partir d'une seule zone de recherche. Vous pouvez également limiter la recherche à Console ou au site public.
Informations de rétention plus claires pour les médias téléchargés
Les images privées téléchargées en tant qu'entrées de tâche sont supprimées lorsque la période de rétention de la tâche prend fin. L'atelier multimédia explique combien de temps les pièces jointes temporaires restent disponibles.
Guides de configuration de l'assistant IA sur le tableau de bord
La vue d'ensemble du tableau de bord inclut désormais des guides de configuration pour l'assistant IA, avec des tutoriels pour Cursor et DeepSeek Harness.
Montants de remboursement et unités de tarification plus clairs dans la facturation
Les requêtes échouées ou ajustées indiquent les montants de remboursement exacts. Les détails de facturation distinguent les types de frais, les unités de tarification, les frais nuls et les tarifs de cache afin que vous puissiez vérifier chaque frais, remboursement et tarif applicable.
Plateforme
Site web TokenLab 2.0 et Console
Le site web TokenLab 2.0 et Console regroupent la sélection de modèles, les clés API, l'utilisation et la facturation dans un seul espace de travail.
Les clients existants n'ont besoin d'effectuer aucun changement.
DeepSeek V4.1 Flash est désormais disponible dans le catalogue en tant que deepseek-v4.1-flash. Les requêtes existantes utilisant deepseek-flash continuent de fonctionner.
Pour les images facturées à l'usage, l'atelier multimédia affiche le taux de jetons de sortie et le montant minimum retenu avant la génération. Vous payez pour l'utilisation réelle, et la page vous indique quand le total ne peut pas être connu à l'avance.
Le catalogue affiche les développeurs de modèles et le statut du cycle de vie
Le catalogue de modèles affiche le développeur et le statut du cycle de vie de chaque modèle, afin que vous puissiez l'examiner avant l'intégration.
Plateforme
Choisissez un mode de livraison pour chaque demande
Auto, TokenLab Verified et Official affichent chacun leur prix correspondant. Définissez une valeur par défaut pour l'espace de travail ou choisissez un mode de livraison par demande avec l'en-tête X-TokenLab-Delivery-Policy. Si le mode sélectionné n'est pas disponible, le API renvoie delivery_tier_unavailable. Les enregistrements de demande indiquent les modes de livraison demandés et résolus.
Les requêtes qui échouent avant leur exécution sont remboursées
Si une requête échoue avant d'être envoyée pour traitement et que son résultat ne peut être confirmé, les frais sont automatiquement remboursés.
Plateforme
Répartition de l'utilisation et des coûts dans le tableau de bord
Consultez l'utilisation et les coûts par clé API, par modèle et par plage de dates pour comprendre vos dépenses sans avoir à exporter au préalable des enregistrements bruts.
Plateforme
Comparer les modèles dans une vue de catalogue unique
Le catalogue de modèles combine l'utilisation hebdomadaire, les classements de tâches et les prix unitaires dans une seule vue.
Les requêtes vidéo prennent en charge les références d'éléments ainsi que la première et la dernière image
Utilisez des références d'éléments pour maintenir la cohérence d'un sujet tout au long d'une vidéo, et définissez la première et la dernière image du clip. Les paramètres pris en charge varient selon le modèle ; consultez la référence de l'API du modèle.
API
Exécuter des tâches d'image en arrière-plan
Soumettez une génération ou une modification d'image en tant que tâche d'arrière-plan et obtenez un identifiant de tâche. Interrogez son statut ou recevez un webhook lorsqu'elle est terminée. La tâche signale sa progression et son coût final, évitant ainsi de maintenir une connexion ouverte pendant un rendu long.
Utilisez une tâche d'arrière-plan lorsqu'un rendu risque de dépasser le délai d'attente de votre client.
Modèles
GLM 5.3, Grok 4.6 et Gemini 3.7 Flash ajoutés
GLM 5.3, Grok 4.6 et Gemini 3.7 Flash sont désormais disponibles dans le catalogue de modèles TokenLab.
Les erreurs de limitation de débit indiquent quand réessayer
Une réponse 429 inclut un en-tête Retry-After, permettant à votre client d'attendre la durée appropriée avant de réessayer.
API
Serveur MCP TokenLab pour les agents de codage
Les agents de codage peuvent rechercher des identifiants de modèles, des tarifs et des détails d'API via le serveur MCP TokenLab avant d'écrire du code d'intégration. Ces recherches n'appellent pas de modèle et ne sont donc pas facturées.
API
API de réponses via WebSocket
Si votre client ne peut pas maintenir un flux d'événements envoyés par le serveur (SSE) ouvert, créez et poursuivez les appels de l'API de réponses via WebSocket à la place.
API
API de synthèse vocale, de transcription et de traduction
Générez de la parole à partir de texte, transcrivez de l'audio et traduisez de l'audio avec la même clé API et le même solde que ceux utilisés pour les modèles de texte.
API
La liste des modèles inclut les capacités
L'API des modèles renvoie les capacités de chaque modèle, permettant aux outils et aux agents de vérifier quels modèles ils peuvent appeler et ce que chacun prend en charge sans avoir à lire la documentation.
API
Actifs de référence Seedance réutilisables
Importez des images et des vidéos de référence une seule fois en tant qu'actifs Seedance, validez-les et réutilisez-les dans vos requêtes vidéo. Gérez-les via l'API ou sur la page des actifs Seedance dans la console.
2026 Q2
API
API de génération 3D
Créez des modèles 3D via l'API. Chaque tâche renvoie un identifiant : vérifiez son statut, puis téléchargez les fichiers de résultat une fois terminée.
API
Exportation d'utilisation et API de gestion
Exportez les enregistrements d'utilisation depuis la console, ou consultez l'utilisation et la facturation pour chaque clé API via l'API de gestion. Utilisez ces données pour le rapprochement et vos tableaux de bord internes.
API
Migration et compatibilité de l'URL de base API
L'URL de base API a été déplacée vers https://api.tokenlab.sh.. L'adresse précédente, https://api.lemondata.cc,, est restée disponible pendant la période de compatibilité annoncée se terminant le 1 juillet 2026.
Utilisez https://api.tokenlab.sh pour les nouvelles intégrations.
Tarification
Ouvrez les factures depuis vos historiques de paiement
Les paiements effectués dans la section Facturation renvoient vers leur facture lorsqu'elle est disponible.
Tarification
Les frais de streaming correspondent à l'utilisation signalée
Pour le chat en streaming, vous êtes facturé selon l'utilisation finale renvoyée par l'API, afin que vos relevés d'utilisation et vos frais concordent.
2026 Q1
API
API d'embeddings et de rerank
Appelez les modèles d'embedding et de rerank avec la même clé API et le même solde que pour le chat. Les erreurs utilisent le même format que les autres points de terminaison.
API
Webhooks pour les tâches asynchrones
Recevez un webhook lorsqu'une tâche asynchrone est terminée, échoue ou expire, au lieu d'interroger son statut.
Tarification
Les tâches asynchrones ayant échoué sont remboursées automatiquement
Si une tâche asynchrone échoue, les frais sont automatiquement recrédités sur votre solde.
Tarification
Les jetons d'entrée mis en cache sont facturés au tarif du cache
Pour les modèles pris en charge, les jetons d'entrée mis en cache sont désormais inclus dans la facturation finale au tarif du cache au lieu du tarif d'entrée standard.
Corrections et améliorations11
Les exportations d'utilisation correspondent aux enregistrements filtrés du tableau de bord
Correction des requêtes et des exportations d'utilisation pour les longues plages de dates et les vues filtrées, afin que les enregistrements exportés correspondent à ceux affichés dans le tableau de bord.
Les modifications d'image conservent l'ordre des images d'entrée
Les modifications d'image impliquant plusieurs images d'entrée les utilisent dans l'ordre où vous les avez envoyées. Si une requête dépasse le délai d'attente de votre client, vous pouvez toujours obtenir le résultat à partir de l'enregistrement de la tâche.
La facturation affiche les petits frais et remboursements
Les petits frais et remboursements ne sont plus arrondis à zéro dans les vues de facturation, ce qui vous permet de voir les coûts par requête inférieurs à un centime.
Les réponses de transcription et de parole synchrone correspondent à la documentation
Correction des formats de réponse pour les points de terminaison de transcription et de parole synchrone afin que les champs et structures renvoyés correspondent à la documentation.
Les réponses sont marquées correctement lorsqu'elles atteignent la limite de longueur
Les réponses qui atteignent la limite de longueur portent désormais le marqueur de troncature correct. L'interface indique que la sortie est incomplète.
Les webhooks de tâche effectuent une nouvelle tentative après des échecs de livraison
Les webhooks de fin de tâche sont relancés après un échec de livraison, afin que les notifications ne dépendent pas d'une seule tentative.
Les requêtes vidéo sans prix publié sont rejetées
Une requête vidéo est rejetée immédiatement lorsque la combinaison de sa taille et de son mode ne possède aucun tarif publié, évitant ainsi toute acceptation à un prix indéfini. La référence à une vidéo utilise les mêmes tarifs publiés que le reste du catalogue vidéo.
Les requêtes textuelles vers les modèles de vision fonctionnent normalement
Une requête contenant uniquement du texte, envoyée à un modèle qui accepte également des images, renvoie désormais une réponse textuelle normale au lieu d'une erreur.
Les limitations de débit temporaires sont réessayées automatiquement
Lorsqu'une requête atteint une limite de débit courte et qu'un nouvel essai est sans risque, TokenLab réessaie automatiquement pour vous, réduisant ainsi le nombre d'échecs de requêtes.
Un format d'erreur unique pour tous les modèles
Les erreurs de chaque modèle utilisent le même format de réponse et des types d'erreurs stables, vous permettant de gérer les échecs de manière centralisée.
Les requêtes d'images trop volumineuses sont désormais rejetées immédiatement
Les requêtes de téléchargement d'images dépassant la taille prise en charge sont rejetées avant tout traitement. Les clients reçoivent immédiatement une erreur claire et la requête ne consomme aucun crédit d'utilisation.
Testez par vous-même
Essayez les dernières nouveautés dans le catalogue de modèles, ou consultez la doc avant de mettre à jour une intégration.