Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Registro de alterações

Novidades

Novos modelos, ajustes de preço e atualizações do produto — tudo aqui. Ver documentação

2026 Q4

Modelos

Gemini Nano Banana 2.1 and Claude Haiku 5.5 are now available

Gemini Nano Banana 2.1 is Google's update to Nano Banana 2 for image generation and editing, with clearer text in images and steadier subjects across edits. Use gemini-nano-banana-2.1 (priced per token) or nano-banana-2.1 (priced per image) with the Images API at 1K, 2K or 4K in 14 aspect ratios. Claude Haiku 5.5 is the fastest model in the Claude 5 series, with text and image input, tool use, structured output, prompt caching, a 1M-token context window and up to 128K output tokens. Use claude-haiku-5-5 or its alias claude-haiku-5.5 with Chat Completions or Messages.

TokenLab Verified prices: Nano Banana 2.1 at 50% off the reference tariff, $0.0168, $0.0252 and $0.0565 per 1K, 2K and 4K image for nano-banana-2.1, and $0.75 input and $15 image output per million tokens for gemini-nano-banana-2.1. Claude Haiku 5.5 at 70% off: $0.03 input and $0.15 output per million tokens for prompts up to 100K tokens, and $0.15 and $0.75 above that, with the same discount on cache reads and writes. Official delivery is available at its listed price.

Modelos
gemini-nano-banana-2.1nano-banana-2.1claude-haiku-5-5
Vigente
View models and pricing
Preço

Preços Verified de 15 modelos caem para 70% do preço oficial

O desconto Verified de 15 modelos GPT, de raciocínio e de embeddings passa de 15% para 30%. Os preços unitários caem de 85% para 70% do preço oficial, uma redução de aproximadamente 17,65%. O mesmo desconto se aplica aos componentes de entrada, saída e cache compatíveis.

Após a entrada em vigor, novas solicitações Verified usarão as novas tarifas. Não é necessário alterar os nomes dos modelos ou as chamadas à API. Os preços Official e as cobranças históricas já liquidadas não mudam.

Modelos
gpt-4.1-minigpt-4ogpt-4o-minigpt-5gpt-5-minigpt-5-nanogpt-5.1gpt-5.2gpt-5.3-codexgpt-5.4gpt-5.4-minigpt-5.4-nanoo3text-embedding-3-largetext-embedding-3-small
Vigente
Ver modelos e preços
Modelos

Catálogo atualizado de modelos de imagem, vídeo e áudio (3/3)

A lista de novidades reúne agora 82 modelos distintos: 46 de imagem, 21 de vídeo, 6 de áudio, 4 de música, 4 de 3D e 1 de Chat. Operações e variantes datadas do mesmo modelo foram agrupadas. Consulte as páginas dos modelos para os parâmetros e operações disponíveis.

Use um ID comum e a operação correspondente para o mesmo modelo. Foram removidos da lista os duplicados e as versões antigas excluídas desta seleção.

Modelos
riverflow-2-5-prorodin-gen-2runway-gen-4-5runway-gen-4-imagerunway-gen-4-image-turbosana-sprintskyreels-v4stable-audio-3-small-music-text-to-audiostable-audio-3-small-sfx-base-text-to-audiostable-audio-3-small-sfx-text-to-audiotopaz-labs-wonder-3-5trellis-2tripo-3d-v3-1uni-1uni-1-maxveed-fabric-1-0wan2-7-imagewan2-7-image-pro
Vigente
Ver modelos
Modelos

Catálogo atualizado de modelos de imagem, vídeo e áudio (2/3)

A lista de novidades reúne agora 82 modelos distintos: 46 de imagem, 21 de vídeo, 6 de áudio, 4 de música, 4 de 3D e 1 de Chat. Operações e variantes datadas do mesmo modelo foram agrupadas. Consulte as páginas dos modelos para os parâmetros e operações disponíveis.

Use um ID comum e a operação correspondente para o mesmo modelo. Foram removidos da lista os duplicados e as versões antigas excluídas desta seleção.

Modelos
krea-2-largekrea-2-mediumkrea-2-medium-turbokrea-2-rawkrea-2-turboltx-2-5-fastltx-2-5-promeshy-6minimax-h3-fastminimax-h3-max-turbominimax-speech-2-8mirelo-sfx-1-5muse-imageomnihuman-1-5p-imagep-image-editp-image-ideogramp-image-upscalep-video-2p-video-2-prop-video-avatarpicsart-image-vectorizerqwen-image-edit-2511qwen-image-layeredqwen3-tts-1-7b-customvoiceqwen3-tts-1-7b-voicedesignray3-2recraft-v4-stylesrecraft-v4-styles-prorecraft-v4-styles-pro-vectorrecraft-v4-styles-vectorriverflow-2-5-fast
Vigente
Ver modelos
Modelos

Catálogo atualizado de modelos de imagem, vídeo e áudio (1/3)

A lista de novidades reúne agora 82 modelos distintos: 46 de imagem, 21 de vídeo, 6 de áudio, 4 de música, 4 de 3D e 1 de Chat. Operações e variantes datadas do mesmo modelo foram agrupadas. Consulte as páginas dos modelos para os parâmetros e operações disponíveis.

Use um ID comum e a operação correspondente para o mesmo modelo. Foram removidos da lista os duplicados e as versões antigas excluídas desta seleção.

Modelos
boogu-image-0-1-editboogu-image-0-1-edit-turbobria-3-2bria-fibobria-fibo-editbria-fibo-litebria-image-increase-resolutionbria-rmbg-v2-0eleven-v4-turboernie-imageernie-image-turboflux-2-devflux-2-klein-4b-baseflux-2-klein-9b-baseflux-2-klein-9b-kvgoogle-gemma-4-31bheygen-video-1-0heygen-video-agentideogram-4-5imagineart-2-0inworld-realtime-tts-2juggernaut-zkling-image-3-0kling-image-o3kling-ttskling-video-3-0-4kkling-video-3-0-omni-4kkling-video-3-0-omni-prokling-video-3-0-omni-standardkling-video-3-0-prokling-video-3-0-standardkling-video-3-0-turbo
Vigente
Ver modelos

2026 Q3

Modelos

Novos modelos de imagem e vídeo e retorno do Speech 2.8 Turbo

Hy Image 3.5 Preview oferece geração de imagens de 1024×1024 a partir de texto e edição de imagens de referência. Hailuo H3-Max gera vídeos de 5 a 15 segundos em 480p/768p a partir de texto, de um primeiro quadro ou de um primeiro e um último quadro. A síntese de voz MiniMax Speech 2.8 Turbo está disponível novamente.

Modelos
hy-image-v3.5-previewhailuo-h3-maxspeech-2.8-turbo
Vigente
Ver modelos
Modelos

Novos modelos de raciocínio, recuperação e mídia

Mistral Medium 3.5, Amazon Nova 2 Lite e Ember-1 juntam-se ao Chat Completions. Voyage, Mistral e Perplexity adicionam embeddings de texto e código. Recraft expande a geração de imagens; Cohere Rerank 4, Fish Transcribe-1, Grok TTS/STT e MiniMax H3 Max adicionam capacidades de reranking, fala e vídeo.

Novos modelos estão disponíveis em OFFICIAL. Ember-1 é uma prévia de pesquisa. Verifique a interface, os limites e o preço publicados de cada modelo antes de alternar.

Modelos
voyage-4-largevoyage-4voyage-4-litevoyage-3-largevoyage-3.5voyage-3.5-litevoyage-code-2voyage-code-3voyage-finance-2voyage-law-2mistral-embedcodestral-embedmistral-medium-3.5nova-2-liteember-1pplx-embed-v1-0.6bpplx-embed-v1-4brecraft-v3recraft-v4recraft-v4-prorecraft-v4.1recraft-v4.1-flashrecraft-v4.1-prorecraft-v4.1-utilityrecraft-v4.1-utility-prorerank-v4.0-fastrerank-v4.0-profish-transcribe-1grok-ttsgrok-sttminimax-h3-max
Vigente
Explorar modelos
Modelos

Veo 3.1 Lite já está disponível

Use veo3.1-lite via /v1/videos/generations para gerar vídeos a partir de texto ou imagens. As especificações públicas iniciais são vídeos de 8 segundos em 720p ou 1080p com áudio, em 16:9 ou 9:16. Consulte a poll_url retornada para obter o resultado.

Modelos
veo3.1-lite
Vigente
Ver modelo
Modelos

Gemini Embedding 2 já está disponível

Use gemini-embedding-2 via /v1/embeddings para gerar embeddings de texto. Aceita textos individuais e lotes de textos, retorna vetores de ponto flutuante e permite configurar as dimensões de saída.

Modelos
gemini-embedding-2
Vigente
Ver modelo
Modelos

GPT-6.1 Sol já está disponível

Use o gpt-6.1-sol no TokenLab com Chat Completions e Responses. O preço padrão por 1 milhão de tokens é $2 para entrada, $0.10 para entrada em cache, $2.50 para gravações no cache e $10 para saída. Acima de 272K tokens de entrada, aplicam-se os preços de contexto longo $4, $0.20, $5 e $15.

Modelos
gpt-6.1-sol
Vigente
Ver modelos
Modelos

Claude Sonnet 5.5 is now available

Claude Sonnet 5.5 joins the Claude 5 series with text and image input, tool use, structured output, prompt caching, a 1M-token context window, and up to 128K output tokens. Use claude-sonnet-5-5 or its alias claude-sonnet-5.5 with Chat Completions, Responses, or Messages.

TokenLab Verified supports Chat Completions and Messages at 70% off the reference tariff: $0.60 input and $3.00 output per million tokens, with the same discount on cache reads and writes. Official delivery supports all three APIs at its listed price. Reasoning is enabled by default; thinking disabled and forced tool choice are not supported by this model.

Modelos
claude-sonnet-5-5
Vigente
View model and pricing
Plataforma

Novo centro para desenvolvedores

O novo centro para desenvolvedores reúne SDKs, ferramentas e recursos de integração.

Ver centro para desenvolvedores
Modelos

Novos modelos de conversa, busca e mídia

Modelos adicionados: Qwen 3.8 Omni Flash, GLM 5.3 FlashX, Step 5 Preview, Hy4 Preview, Qwen 3.7 Text Embedding, Qwen 3.7 Text Embedding Flash, Qwen 3.7 Text Rerank, Doubao Seed 2.1 Lite, Seedream 5.0 Flash, Kimi K2.8 Preview, FLUX 3 Video, FLUX Video Edit, Stable Audio 3.0. Consulte os recursos e preços atuais no catálogo de modelos.

Modelos
qwen3.8-omni-flashglm-5.3-flashxstep-5-previewhy4-previewqwen3.7-text-embeddingqwen3.7-text-embedding-flashqwen3.7-text-rerankdoubao-seed-2.1-liteseedream-5.0-flashkimi-k2.8-previewflux-3-videoflux-video-editstable-audio-3
Vigente
Ver modelos
Modelos

Jev 1.13 está disponível para decisões tipadas

Use jev-1.13 por meio de POST /v1/systemone para avaliar probabilidades Noul, seleções de Choice e classificações de Score em relação ao estado compartilhado. A ferramenta MCP do TokenLab evaluate_decisions oferece suporte à mesma solicitação nativa.

Mantenha os resultados das decisões estruturados. Seu aplicativo controla a validação, os limites de confiança, as permissões e as ações.

Modelos
jev-1.13
Vigente
Leia a referência da API System One
Preço

Atualizações de preços de imagem e vídeo

Modelos de imagem e vídeo selecionados agora oferecem 5%–85% off com TokenLab Verified; consulte o catálogo para cada modelo. Wan 2.6 TokenLab Verified muda de $0.60 por solicitação para precificação baseada em duração: cerca de $0.08824/segundo a 720p e $0.14706/segundo a 1080p. Um vídeo de 5 segundos custa cerca de $0.4412 ou $0.7353, respectivamente. Gemini 3 Pro Image, Gemini 3.1 Flash Image e Gemini 3.1 Flash Lite Image faturam entradas e saídas de texto e imagem separadamente, com TokenLab Verified permanecendo 50% off.

Aplica-se a novas solicitações. O catálogo de modelos lista as taxas exatas para cada configuração; as cobranças históricas permanecem inalteradas.

Modelos
wan-2.6gemini-3-pro-imagegemini-3.1-flash-imagegemini-3.1-flash-lite-imagegrok-imagine-image-2.0grok-imagine-videogrok-imagine-video-1.5-previewhailuo-2.3-standardimage-background-removerimage-upscalerkling-v2.1-masterqwen-imageqwen-image-editz-image
Vigente
Ver preços e disponibilidade de modelos
Preço

Aumentos de preço para modelos selecionados

Para TokenLab Verified, GPT-5.4 e GPT-5.4 mini mudam de 70% off para 15% off; Kling 3.0 muda de 30% off para o preço oficial listado. HappyHorse 1.1 a 720p, 5 segundos, sem áudio, sobe de cerca de $0.4332 para $0.6188. Na qualidade Padrão, Ideogram v3 sobe de $0.04 para $0.06 por imagem; Edit, Reframe e Remix v3 sobem de $0.02 para $0.06 por imagem.

Aplica-se a novas solicitações de TokenLab Verified. Outras configurações são precificadas conforme mostrado no catálogo de modelos; solicitações aceitas anteriormente e cobranças históricas permanecem inalteradas.

Modelos
gpt-5.4gpt-5.4-minikling-v3.0happyhorse-1.1ideogram-v3ideogram-edit-v3ideogram-reframe-v3ideogram-remix-v3
Vigente
Ver preços e disponibilidade de modelos
Preço

Descontos atualizados para modelos de chat e embedding

Para os modelos nesta atualização, TokenLab Verified oferece modelos 70% off Claude e GPT-5.6 Luna; 15% off os outros modelos GPT, o3 e text-embedding-3; e 50% off Grok 4.6 e 4.7. Os modelos afetados estão listados abaixo; consulte o catálogo para preços individuais.

Aplica-se a novas solicitações de TokenLab Verified. Solicitações aceitas anteriormente e cobranças históricas permanecem inalteradas.

Modelos
claude-fable-5claude-fable-5-1claude-haiku-4-5claude-opus-4-6claude-opus-4-7claude-opus-4-8claude-opus-5claude-opus-5-5claude-sonnet-4-6claude-sonnet-5gpt-5.6-lunagpt-4.1-minigpt-4ogpt-4o-minigpt-5gpt-5-minigpt-5-nanogpt-5.1gpt-5.2gpt-5.3-codexgpt-5.4-nanogrok-4.6grok-4.7o3text-embedding-3-largetext-embedding-3-small
Vigente
Preço
15%–70% off
Ver preços e disponibilidade de modelos
Modelos

Mudanças de disponibilidade para modelos selecionados

Seedance 1.5 Pro e Suno Lyrics não aceitam mais novas solicitações. Seedance 2.0 Fast, Seedance 2.0 Mini e FLUX 2 Flex text-to-image estão disponíveis através de Auto ou Official; FLUX a edição de imagem ainda suporta TokenLab Verified. Wan 2.6 continua a suportar text-to-video e image-to-video, mas não suporta mais reference-to-video.

Chaves restritas a TokenLab Verified não podem usar essas opções exclusivas de Official. Tarefas aceitas anteriormente e registros históricos permanecem disponíveis.

Modelos
seedance-1.5-prosuno-lyricsseedance-2.0-fastseedance-2.0-miniwan-2.6flux-2-flex
Vigente
Ver preços e disponibilidade de modelos
Preço

Atualizações de faturamento de cache e contexto longo

Para entrega de Official, a criação de cache de GLM-5, GLM-5.1 e GLM-5.2 agora usa a taxa de entrada padrão; leituras em cache mantêm sua taxa com desconto listada e os preços de TokenLab Verified permanecem inalterados. Taxas de contexto longo aplicam-se a Grok 4.20 com 200,000 tokens de entrada ou mais e Qwen 3.6 Max Preview acima de 128,000 tokens de entrada. Grok 4.20 TokenLab Verified permanece 50% off a camada aplicável; os preços de Qwen TokenLab Verified permanecem inalterados.

Aplica-se a novas solicitações que atendam a essas condições. Consulte a precificação de modelos para taxas; as cobranças históricas permanecem inalteradas.

Modelos
grok-4.20qwen3.6-max-previewglm-5glm-5.1glm-5.2
Vigente
Ver preços e disponibilidade de modelos
Preço

Gemini 2.5 Flash e Flash Lite: 50% off

Gemini 2.5 Flash está disponível com precificação TokenLab Verified de $0.15 por milhão de tokens de entrada e $1.25 por milhão de tokens de saída. Gemini 2.5 Flash Lite custa $0.05 de entrada e $0.20 de saída por milhão de tokens. Ambos estão 50% off os preços oficiais listados; os preços de entrada em cache são $0.015 e $0.005 por milhão de tokens, respectivamente.

Modelos
gemini-2.5-flashgemini-2.5-flash-lite
Vigente
Preço
50% off (TokenLab Verified)
Ver preços de modelos
Modelos

GPT-6 Sol, GPT-6 Luna e Claude Opus 5.5 já estão disponíveis

Use gpt-6-sol, gpt-6-luna e claude-opus-5-5 em TokenLab. Consulte o catálogo de modelos para suas capacidades e preços atuais.

Modelos
gpt-6-solgpt-6-lunaclaude-opus-5-5
Vigente
Navegar pelos modelos
Plataforma

Chat no Console: streaming, ferramentas e pesquisa na web

O chat no Console transmite respostas e pode usar ferramentas de função e pesquisa na web, com os resultados das ferramentas sendo alimentados de volta na conversa. Defina ferramentas de função no editor JSON. Cada resposta mostra seu tempo até o primeiro token.

Plataforma

Bancada de mídia: edições de múltiplas imagens e primeiro/último quadro de vídeo

Edite uma imagem com várias imagens de referência ou defina o primeiro e o último quadro de um vídeo. Cada controle mostra seu intervalo permitido.

Abrir Console
Plataforma

Visualize e baixe resultados nos detalhes da tarefa

Abra uma tarefa para visualizar e baixar os arquivos de mídia e modelos 3D gerados por ela.

Plataforma

Requisições falhas mostram a causa e o reembolso

No Console, os detalhes de uma requisição falha mostram o que deu errado e o valor exato reembolsado. Apenas membros da sua organização podem visualizá-los.

Abrir Console
Plataforma

Pesquise modelos, páginas e documentos em um só lugar

Encontre modelos, páginas do site e documentação a partir de uma única caixa de pesquisa. Você também pode limitar a pesquisa a Console ou ao site público.

Ver documentação
Plataforma

Informações mais claras sobre a retenção de mídia enviada

Imagens privadas enviadas como entradas de tarefa são removidas quando o período de retenção da tarefa termina. A bancada de trabalho de mídia explica por quanto tempo os anexos temporários permanecem disponíveis.

Abrir Console
Plataforma

Guias de configuração do assistente de IA no painel

A visão geral do painel agora inclui guias de configuração do assistente de IA, com tutoriais para o Cursor e o DeepSeek Harness.

Abrir Console
Preço

Valores de reembolso e unidades de taxa mais claros no faturamento

Solicitações falhas ou ajustadas mostram os valores exatos de reembolso. Os detalhes de faturamento distinguem tipos de cobrança, unidades de taxa, cobranças zero e taxas de cache para que você possa verificar cada cobrança, reembolso e taxa aplicável.

Plataforma

Site TokenLab 2.0 e Console

O site TokenLab 2.0 e o Console reúnem a seleção de modelos, chaves API, uso e faturamento em um único espaço de trabalho.

Clientes existentes não precisam realizar alterações.

Abrir Console
Modelos

DeepSeek V4.1 Flash está disponível

DeepSeek V4.1 Flash está agora no catálogo como deepseek-v4.1-flash. Solicitações existentes usando deepseek-flash continuam a funcionar.

Modelos
deepseek-v4.1-flash
Vigente
Ver modelos
Modelos

GPT Image 2.5 Sunburst e Flare estão disponíveis

GPT Image 2.5 Sunburst e Flare agora estão no catálogo, com geração e edição de imagens por meio da TokenLab Images API.

Modelos
gpt-image-2.5-sunburstgpt-image-2.5-flare
Vigente
Ver modelos
Plataforma

Veja as taxas de imagem antes de gerar

Para imagens cobradas por uso, a bancada de trabalho de mídia mostra a taxa de tokens de saída e o valor mínimo retido antes da geração. Você paga pelo uso real, e a página informa quando o total não pode ser conhecido com antecedência.

Abrir Console
Modelos

Gemini 3.8 Flash e GPT 6 Astra adicionados

Gemini 3.8 Flash e GPT 6 Astra agora estão disponíveis no catálogo de modelos TokenLab.

Modelos
gemini-3.8-flashgpt-6-astra
Vigente
Navegar pelos modelos
Plataforma

O catálogo mostra desenvolvedores de modelos e status do ciclo de vida

O catálogo de modelos mostra o desenvolvedor e o status do ciclo de vida de cada modelo, para que você possa analisá-lo antes da integração.

Plataforma

Escolha um modo de entrega para cada solicitação

Auto, TokenLab Verified e Official mostram cada um seu preço correspondente. Defina um padrão de espaço de trabalho ou escolha um modo de entrega por solicitação com o cabeçalho X-TokenLab-Delivery-Policy. Se o modo selecionado não estiver disponível, o API retorna delivery_tier_unavailable. Os registros de solicitação mostram os modos de entrega solicitados e resolvidos.

Abrir no Console
Preço

Solicitações que falham antes da execução são reembolsadas

Se uma solicitação falhar antes de ser enviada para processamento e seu resultado não puder ser confirmado, a cobrança será reembolsada automaticamente.

Plataforma

Detalhamento de uso e custo no painel

Visualize o uso e o custo por chave API, modelo e intervalo de tempo para entender os gastos sem precisar exportar registros brutos primeiro.

Plataforma

Compare modelos em uma única visualização de catálogo

O catálogo de modelos combina o uso semanal, classificações de tarefas e preços unitários em uma única visualização.

Navegar pelos modelos
API

Requisições de vídeo suportam referências de elementos e quadros inicial/final

Use referências de elementos para manter um assunto consistente ao longo de um vídeo e defina o primeiro e o último quadro do clipe. Os parâmetros suportados variam de acordo com o modelo; consulte a referência da API do modelo.

API

Execute tarefas de imagem em segundo plano

Envie uma geração ou edição de imagem como uma tarefa em segundo plano e obtenha um ID de tarefa. Verifique seu status ou receba um webhook quando ela for concluída. A tarefa informa o progresso e o custo final, para que uma renderização longa não mantenha uma conexão aberta.

Use uma tarefa em segundo plano quando uma renderização puder levar mais tempo do que o tempo limite (timeout) do seu cliente.

Modelos

GLM 5.3, Grok 4.6 e Gemini 3.7 Flash adicionados

GLM 5.3, Grok 4.6 e Gemini 3.7 Flash agora estão disponíveis no catálogo de modelos TokenLab.

Modelos
glm-5.3grok-4.6gemini-3.7-flash
Vigente
Navegar pelos modelos
API

Erros de limite de taxa indicam quando tentar novamente

Uma resposta 429 inclui um cabeçalho Retry-After, para que seu cliente possa aguardar o tempo correto antes de tentar novamente.

API

Servidor MCP TokenLab para agentes de codificação

Agentes de codificação podem consultar IDs de modelos, preços e detalhes da API através do servidor MCP TokenLab antes de escreverem o código de integração. As consultas não chamam um modelo, portanto, não são cobradas.

API

API de respostas via WebSocket

Se o seu cliente não puder manter um fluxo de eventos enviados pelo servidor (SSE) aberto, crie e continue chamadas da API de Respostas via WebSocket.

API

APIs de fala, transcrição e tradução

Gere fala a partir de texto, transcreva áudio e traduza áudio com a mesma chave de API e saldo que você usa para modelos de texto.

API

Lista de modelos inclui capacidades

A API de modelos retorna as capacidades de cada modelo, para que ferramentas e agentes possam verificar quais modelos podem chamar e o que cada um suporta sem precisar ler a documentação.

API

Ativos de referência reutilizáveis Seedance

Faça upload de imagens e vídeos de referência uma vez como ativos Seedance, valide-os e reutilize-os em requisições de vídeo. Gerencie-os através da API ou na página de ativos Seedance no Console.

2026 Q2

API

API de geração 3D

Crie modelos 3D através da API. Cada trabalho retorna um ID de tarefa: verifique seu status e baixe os arquivos de resultado quando estiver concluído.

API

Exportação de uso e API de Gerenciamento

Exporte registros de uso do Console ou leia o uso e o faturamento de cada chave de API através da API de Gerenciamento. Use-os para reconciliação e painéis internos.

API

Migração e compatibilidade da URL base API

A URL base API foi movida para https://api.tokenlab.sh.. O endereço anterior, https://api.lemondata.cc,, permaneceu disponível durante a janela de compatibilidade anunciada que terminou em 1 de julho de 2026.

Use https://api.tokenlab.sh para novas integrações.

Preço

As cobranças de streaming correspondem ao uso reportado

Para chats via streaming, você é cobrado pelo uso final retornado pela API, para que seus registros de uso e cobranças estejam em conformidade.

2026 Q1

API

APIs de embedding e rerank

Chame modelos de embedding e rerank com a mesma chave de API e saldo do chat. Os erros usam o mesmo formato dos outros endpoints.

API

Webhooks para tarefas assíncronas

Receba um webhook quando uma tarefa assíncrona for concluída, falhar ou expirar, em vez de verificar seu status.

Preço

Tarefas assíncronas com falha são reembolsadas automaticamente

Se uma tarefa assíncrona falhar, a cobrança correspondente retorna automaticamente ao seu saldo.

Preço

Tokens de entrada em cache são cobrados pela taxa de cache

Para modelos suportados, os tokens de entrada em cache agora são incluídos na cobrança final pela taxa de cache, em vez da taxa de entrada padrão.

Correções e melhorias11
  • Exportações de uso correspondem aos registros filtrados do painel

    Corrigimos consultas e exportações de uso para longos intervalos de datas e visualizações filtradas, para que os registros exportados correspondam aos exibidos no painel.

  • Edições de imagem mantêm a ordem das imagens de entrada

    Edições de imagem com várias imagens de entrada as utilizam na ordem em que você as enviou. Se uma requisição ultrapassar o tempo limite do seu cliente, você ainda pode obter o resultado a partir do registro da tarefa.

  • O faturamento exibe pequenas cobranças e reembolsos

    Pequenas cobranças e reembolsos não são mais arredondados para zero nas visualizações de faturamento, para que você possa ver os custos por solicitação abaixo de um centavo.

  • Respostas de transcrição e fala síncrona correspondem à documentação

    Corrigidos os formatos de resposta para endpoints de transcrição e fala síncrona, de modo que os campos e estruturas retornados correspondam à documentação.

  • Respostas são marcadas corretamente quando atingem o limite de comprimento

    Respostas que atingem o limite de comprimento agora contêm o marcador de truncamento correto. A interface indica que a saída está incompleta.

  • Webhooks de tarefa tentam novamente após falhas de entrega

    Webhooks de conclusão de tarefa são tentados novamente após uma falha de entrega, para que as notificações não dependam de uma única tentativa.

  • Solicitações de vídeo sem um preço publicado são rejeitadas

    Uma solicitação de vídeo é rejeitada antecipadamente quando sua combinação de tamanho e modo não possui uma taxa publicada, evitando a aceitação a um preço incerto. A referência para vídeo utiliza as mesmas taxas publicadas que o restante do catálogo de vídeos.

  • Requisições apenas de texto para modelos de visão funcionam normalmente

    Uma requisição apenas com texto, enviada a um modelo que também aceita imagens, agora retorna uma resposta de texto normal em vez de um erro.

  • Limites de taxa curtos são tentados novamente automaticamente

    Quando uma requisição atinge um limite de taxa curto e uma nova tentativa é segura, o TokenLab tenta novamente para você, resultando em menos falhas nas requisições.

  • Um formato de erro para todos os modelos

    Erros de todos os modelos usam o mesmo formato de resposta e tipos de erro estáveis, para que você possa tratar falhas em um único lugar.

  • Solicitações de imagem com tamanho excessivo são rejeitadas antecipadamente

    Solicitações de upload de imagem que excedem o tamanho suportado são rejeitadas antes do processamento. Os clientes recebem um erro claro imediatamente, e a solicitação não consome uso.

Veja na prática

Experimente as novidades no catálogo de modelos ou consulte a documentação antes de atualizar uma integração.