Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades
Registro de alterações
Novidades
Novos modelos, ajustes de preço e atualizações do produto — tudo aqui. Ver documentação
2026 Q4
Modelos
Gemini Nano Banana 2.1 and Claude Haiku 5.5 are now available
Gemini Nano Banana 2.1 is Google's update to Nano Banana 2 for image generation and editing, with clearer text in images and steadier subjects across edits. Use gemini-nano-banana-2.1 (priced per token) or nano-banana-2.1 (priced per image) with the Images API at 1K, 2K or 4K in 14 aspect ratios. Claude Haiku 5.5 is the fastest model in the Claude 5 series, with text and image input, tool use, structured output, prompt caching, a 1M-token context window and up to 128K output tokens. Use claude-haiku-5-5 or its alias claude-haiku-5.5 with Chat Completions or Messages.
TokenLab Verified prices: Nano Banana 2.1 at 50% off the reference tariff, $0.0168, $0.0252 and $0.0565 per 1K, 2K and 4K image for nano-banana-2.1, and $0.75 input and $15 image output per million tokens for gemini-nano-banana-2.1. Claude Haiku 5.5 at 70% off: $0.03 input and $0.15 output per million tokens for prompts up to 100K tokens, and $0.15 and $0.75 above that, with the same discount on cache reads and writes. Official delivery is available at its listed price.
Preços Verified de 15 modelos caem para 70% do preço oficial
O desconto Verified de 15 modelos GPT, de raciocínio e de embeddings passa de 15% para 30%. Os preços unitários caem de 85% para 70% do preço oficial, uma redução de aproximadamente 17,65%. O mesmo desconto se aplica aos componentes de entrada, saída e cache compatíveis.
Após a entrada em vigor, novas solicitações Verified usarão as novas tarifas. Não é necessário alterar os nomes dos modelos ou as chamadas à API. Os preços Official e as cobranças históricas já liquidadas não mudam.
Catálogo atualizado de modelos de imagem, vídeo e áudio (3/3)
A lista de novidades reúne agora 82 modelos distintos: 46 de imagem, 21 de vídeo, 6 de áudio, 4 de música, 4 de 3D e 1 de Chat. Operações e variantes datadas do mesmo modelo foram agrupadas. Consulte as páginas dos modelos para os parâmetros e operações disponíveis.
Use um ID comum e a operação correspondente para o mesmo modelo. Foram removidos da lista os duplicados e as versões antigas excluídas desta seleção.
Catálogo atualizado de modelos de imagem, vídeo e áudio (2/3)
A lista de novidades reúne agora 82 modelos distintos: 46 de imagem, 21 de vídeo, 6 de áudio, 4 de música, 4 de 3D e 1 de Chat. Operações e variantes datadas do mesmo modelo foram agrupadas. Consulte as páginas dos modelos para os parâmetros e operações disponíveis.
Use um ID comum e a operação correspondente para o mesmo modelo. Foram removidos da lista os duplicados e as versões antigas excluídas desta seleção.
Catálogo atualizado de modelos de imagem, vídeo e áudio (1/3)
A lista de novidades reúne agora 82 modelos distintos: 46 de imagem, 21 de vídeo, 6 de áudio, 4 de música, 4 de 3D e 1 de Chat. Operações e variantes datadas do mesmo modelo foram agrupadas. Consulte as páginas dos modelos para os parâmetros e operações disponíveis.
Use um ID comum e a operação correspondente para o mesmo modelo. Foram removidos da lista os duplicados e as versões antigas excluídas desta seleção.
Novos modelos de imagem e vídeo e retorno do Speech 2.8 Turbo
Hy Image 3.5 Preview oferece geração de imagens de 1024×1024 a partir de texto e edição de imagens de referência. Hailuo H3-Max gera vídeos de 5 a 15 segundos em 480p/768p a partir de texto, de um primeiro quadro ou de um primeiro e um último quadro. A síntese de voz MiniMax Speech 2.8 Turbo está disponível novamente.
Mistral Medium 3.5, Amazon Nova 2 Lite e Ember-1 juntam-se ao Chat Completions. Voyage, Mistral e Perplexity adicionam embeddings de texto e código. Recraft expande a geração de imagens; Cohere Rerank 4, Fish Transcribe-1, Grok TTS/STT e MiniMax H3 Max adicionam capacidades de reranking, fala e vídeo.
Novos modelos estão disponíveis em OFFICIAL. Ember-1 é uma prévia de pesquisa. Verifique a interface, os limites e o preço publicados de cada modelo antes de alternar.
Use veo3.1-lite via /v1/videos/generations para gerar vídeos a partir de texto ou imagens. As especificações públicas iniciais são vídeos de 8 segundos em 720p ou 1080p com áudio, em 16:9 ou 9:16. Consulte a poll_url retornada para obter o resultado.
Use gemini-embedding-2 via /v1/embeddings para gerar embeddings de texto. Aceita textos individuais e lotes de textos, retorna vetores de ponto flutuante e permite configurar as dimensões de saída.
Use o gpt-6.1-sol no TokenLab com Chat Completions e Responses. O preço padrão por 1 milhão de tokens é $2 para entrada, $0.10 para entrada em cache, $2.50 para gravações no cache e $10 para saída. Acima de 272K tokens de entrada, aplicam-se os preços de contexto longo $4, $0.20, $5 e $15.
Claude Sonnet 5.5 joins the Claude 5 series with text and image input, tool use, structured output, prompt caching, a 1M-token context window, and up to 128K output tokens. Use claude-sonnet-5-5 or its alias claude-sonnet-5.5 with Chat Completions, Responses, or Messages.
TokenLab Verified supports Chat Completions and Messages at 70% off the reference tariff: $0.60 input and $3.00 output per million tokens, with the same discount on cache reads and writes. Official delivery supports all three APIs at its listed price. Reasoning is enabled by default; thinking disabled and forced tool choice are not supported by this model.
Use jev-1.13 por meio de POST /v1/systemone para avaliar probabilidades Noul, seleções de Choice e classificações de Score em relação ao estado compartilhado. A ferramenta MCP do TokenLab evaluate_decisions oferece suporte à mesma solicitação nativa.
Mantenha os resultados das decisões estruturados. Seu aplicativo controla a validação, os limites de confiança, as permissões e as ações.
Modelos de imagem e vídeo selecionados agora oferecem 5%–85% off com TokenLab Verified; consulte o catálogo para cada modelo. Wan 2.6 TokenLab Verified muda de $0.60 por solicitação para precificação baseada em duração: cerca de $0.08824/segundo a 720p e $0.14706/segundo a 1080p. Um vídeo de 5 segundos custa cerca de $0.4412 ou $0.7353, respectivamente. Gemini 3 Pro Image, Gemini 3.1 Flash Image e Gemini 3.1 Flash Lite Image faturam entradas e saídas de texto e imagem separadamente, com TokenLab Verified permanecendo 50% off.
Aplica-se a novas solicitações. O catálogo de modelos lista as taxas exatas para cada configuração; as cobranças históricas permanecem inalteradas.
Para TokenLab Verified, GPT-5.4 e GPT-5.4 mini mudam de 70% off para 15% off; Kling 3.0 muda de 30% off para o preço oficial listado. HappyHorse 1.1 a 720p, 5 segundos, sem áudio, sobe de cerca de $0.4332 para $0.6188. Na qualidade Padrão, Ideogram v3 sobe de $0.04 para $0.06 por imagem; Edit, Reframe e Remix v3 sobem de $0.02 para $0.06 por imagem.
Aplica-se a novas solicitações de TokenLab Verified. Outras configurações são precificadas conforme mostrado no catálogo de modelos; solicitações aceitas anteriormente e cobranças históricas permanecem inalteradas.
Descontos atualizados para modelos de chat e embedding
Para os modelos nesta atualização, TokenLab Verified oferece modelos 70% off Claude e GPT-5.6 Luna; 15% off os outros modelos GPT, o3 e text-embedding-3; e 50% off Grok 4.6 e 4.7. Os modelos afetados estão listados abaixo; consulte o catálogo para preços individuais.
Aplica-se a novas solicitações de TokenLab Verified. Solicitações aceitas anteriormente e cobranças históricas permanecem inalteradas.
Mudanças de disponibilidade para modelos selecionados
Seedance 1.5 Pro e Suno Lyrics não aceitam mais novas solicitações. Seedance 2.0 Fast, Seedance 2.0 Mini e FLUX 2 Flex text-to-image estão disponíveis através de Auto ou Official; FLUX a edição de imagem ainda suporta TokenLab Verified. Wan 2.6 continua a suportar text-to-video e image-to-video, mas não suporta mais reference-to-video.
Chaves restritas a TokenLab Verified não podem usar essas opções exclusivas de Official. Tarefas aceitas anteriormente e registros históricos permanecem disponíveis.
Atualizações de faturamento de cache e contexto longo
Para entrega de Official, a criação de cache de GLM-5, GLM-5.1 e GLM-5.2 agora usa a taxa de entrada padrão; leituras em cache mantêm sua taxa com desconto listada e os preços de TokenLab Verified permanecem inalterados. Taxas de contexto longo aplicam-se a Grok 4.20 com 200,000 tokens de entrada ou mais e Qwen 3.6 Max Preview acima de 128,000 tokens de entrada. Grok 4.20 TokenLab Verified permanece 50% off a camada aplicável; os preços de Qwen TokenLab Verified permanecem inalterados.
Aplica-se a novas solicitações que atendam a essas condições. Consulte a precificação de modelos para taxas; as cobranças históricas permanecem inalteradas.
Gemini 2.5 Flash está disponível com precificação TokenLab Verified de $0.15 por milhão de tokens de entrada e $1.25 por milhão de tokens de saída. Gemini 2.5 Flash Lite custa $0.05 de entrada e $0.20 de saída por milhão de tokens. Ambos estão 50% off os preços oficiais listados; os preços de entrada em cache são $0.015 e $0.005 por milhão de tokens, respectivamente.
Chat no Console: streaming, ferramentas e pesquisa na web
O chat no Console transmite respostas e pode usar ferramentas de função e pesquisa na web, com os resultados das ferramentas sendo alimentados de volta na conversa. Defina ferramentas de função no editor JSON. Cada resposta mostra seu tempo até o primeiro token.
Plataforma
Bancada de mídia: edições de múltiplas imagens e primeiro/último quadro de vídeo
Edite uma imagem com várias imagens de referência ou defina o primeiro e o último quadro de um vídeo. Cada controle mostra seu intervalo permitido.
Visualize e baixe resultados nos detalhes da tarefa
Abra uma tarefa para visualizar e baixar os arquivos de mídia e modelos 3D gerados por ela.
Plataforma
Requisições falhas mostram a causa e o reembolso
No Console, os detalhes de uma requisição falha mostram o que deu errado e o valor exato reembolsado. Apenas membros da sua organização podem visualizá-los.
Pesquise modelos, páginas e documentos em um só lugar
Encontre modelos, páginas do site e documentação a partir de uma única caixa de pesquisa. Você também pode limitar a pesquisa a Console ou ao site público.
Informações mais claras sobre a retenção de mídia enviada
Imagens privadas enviadas como entradas de tarefa são removidas quando o período de retenção da tarefa termina. A bancada de trabalho de mídia explica por quanto tempo os anexos temporários permanecem disponíveis.
Valores de reembolso e unidades de taxa mais claros no faturamento
Solicitações falhas ou ajustadas mostram os valores exatos de reembolso. Os detalhes de faturamento distinguem tipos de cobrança, unidades de taxa, cobranças zero e taxas de cache para que você possa verificar cada cobrança, reembolso e taxa aplicável.
Plataforma
Site TokenLab 2.0 e Console
O site TokenLab 2.0 e o Console reúnem a seleção de modelos, chaves API, uso e faturamento em um único espaço de trabalho.
Clientes existentes não precisam realizar alterações.
Para imagens cobradas por uso, a bancada de trabalho de mídia mostra a taxa de tokens de saída e o valor mínimo retido antes da geração. Você paga pelo uso real, e a página informa quando o total não pode ser conhecido com antecedência.
O catálogo mostra desenvolvedores de modelos e status do ciclo de vida
O catálogo de modelos mostra o desenvolvedor e o status do ciclo de vida de cada modelo, para que você possa analisá-lo antes da integração.
Plataforma
Escolha um modo de entrega para cada solicitação
Auto, TokenLab Verified e Official mostram cada um seu preço correspondente. Defina um padrão de espaço de trabalho ou escolha um modo de entrega por solicitação com o cabeçalho X-TokenLab-Delivery-Policy. Se o modo selecionado não estiver disponível, o API retorna delivery_tier_unavailable. Os registros de solicitação mostram os modos de entrega solicitados e resolvidos.
Solicitações que falham antes da execução são reembolsadas
Se uma solicitação falhar antes de ser enviada para processamento e seu resultado não puder ser confirmado, a cobrança será reembolsada automaticamente.
Plataforma
Detalhamento de uso e custo no painel
Visualize o uso e o custo por chave API, modelo e intervalo de tempo para entender os gastos sem precisar exportar registros brutos primeiro.
Plataforma
Compare modelos em uma única visualização de catálogo
O catálogo de modelos combina o uso semanal, classificações de tarefas e preços unitários em uma única visualização.
Requisições de vídeo suportam referências de elementos e quadros inicial/final
Use referências de elementos para manter um assunto consistente ao longo de um vídeo e defina o primeiro e o último quadro do clipe. Os parâmetros suportados variam de acordo com o modelo; consulte a referência da API do modelo.
API
Execute tarefas de imagem em segundo plano
Envie uma geração ou edição de imagem como uma tarefa em segundo plano e obtenha um ID de tarefa. Verifique seu status ou receba um webhook quando ela for concluída. A tarefa informa o progresso e o custo final, para que uma renderização longa não mantenha uma conexão aberta.
Use uma tarefa em segundo plano quando uma renderização puder levar mais tempo do que o tempo limite (timeout) do seu cliente.
Modelos
GLM 5.3, Grok 4.6 e Gemini 3.7 Flash adicionados
GLM 5.3, Grok 4.6 e Gemini 3.7 Flash agora estão disponíveis no catálogo de modelos TokenLab.
Erros de limite de taxa indicam quando tentar novamente
Uma resposta 429 inclui um cabeçalho Retry-After, para que seu cliente possa aguardar o tempo correto antes de tentar novamente.
API
Servidor MCP TokenLab para agentes de codificação
Agentes de codificação podem consultar IDs de modelos, preços e detalhes da API através do servidor MCP TokenLab antes de escreverem o código de integração. As consultas não chamam um modelo, portanto, não são cobradas.
API
API de respostas via WebSocket
Se o seu cliente não puder manter um fluxo de eventos enviados pelo servidor (SSE) aberto, crie e continue chamadas da API de Respostas via WebSocket.
API
APIs de fala, transcrição e tradução
Gere fala a partir de texto, transcreva áudio e traduza áudio com a mesma chave de API e saldo que você usa para modelos de texto.
API
Lista de modelos inclui capacidades
A API de modelos retorna as capacidades de cada modelo, para que ferramentas e agentes possam verificar quais modelos podem chamar e o que cada um suporta sem precisar ler a documentação.
API
Ativos de referência reutilizáveis Seedance
Faça upload de imagens e vídeos de referência uma vez como ativos Seedance, valide-os e reutilize-os em requisições de vídeo. Gerencie-os através da API ou na página de ativos Seedance no Console.
2026 Q2
API
API de geração 3D
Crie modelos 3D através da API. Cada trabalho retorna um ID de tarefa: verifique seu status e baixe os arquivos de resultado quando estiver concluído.
API
Exportação de uso e API de Gerenciamento
Exporte registros de uso do Console ou leia o uso e o faturamento de cada chave de API através da API de Gerenciamento. Use-os para reconciliação e painéis internos.
API
Migração e compatibilidade da URL base API
A URL base API foi movida para https://api.tokenlab.sh.. O endereço anterior, https://api.lemondata.cc,, permaneceu disponível durante a janela de compatibilidade anunciada que terminou em 1 de julho de 2026.
Use https://api.tokenlab.sh para novas integrações.
Preço
Abra faturas a partir de seus registros de pagamento
Pagamentos concluídos em Faturamento contêm links para suas respectivas faturas, quando disponíveis.
Preço
As cobranças de streaming correspondem ao uso reportado
Para chats via streaming, você é cobrado pelo uso final retornado pela API, para que seus registros de uso e cobranças estejam em conformidade.
2026 Q1
API
APIs de embedding e rerank
Chame modelos de embedding e rerank com a mesma chave de API e saldo do chat. Os erros usam o mesmo formato dos outros endpoints.
API
Webhooks para tarefas assíncronas
Receba um webhook quando uma tarefa assíncrona for concluída, falhar ou expirar, em vez de verificar seu status.
Preço
Tarefas assíncronas com falha são reembolsadas automaticamente
Se uma tarefa assíncrona falhar, a cobrança correspondente retorna automaticamente ao seu saldo.
Preço
Tokens de entrada em cache são cobrados pela taxa de cache
Para modelos suportados, os tokens de entrada em cache agora são incluídos na cobrança final pela taxa de cache, em vez da taxa de entrada padrão.
Correções e melhorias11
Exportações de uso correspondem aos registros filtrados do painel
Corrigimos consultas e exportações de uso para longos intervalos de datas e visualizações filtradas, para que os registros exportados correspondam aos exibidos no painel.
Edições de imagem mantêm a ordem das imagens de entrada
Edições de imagem com várias imagens de entrada as utilizam na ordem em que você as enviou. Se uma requisição ultrapassar o tempo limite do seu cliente, você ainda pode obter o resultado a partir do registro da tarefa.
O faturamento exibe pequenas cobranças e reembolsos
Pequenas cobranças e reembolsos não são mais arredondados para zero nas visualizações de faturamento, para que você possa ver os custos por solicitação abaixo de um centavo.
Respostas de transcrição e fala síncrona correspondem à documentação
Corrigidos os formatos de resposta para endpoints de transcrição e fala síncrona, de modo que os campos e estruturas retornados correspondam à documentação.
Respostas são marcadas corretamente quando atingem o limite de comprimento
Respostas que atingem o limite de comprimento agora contêm o marcador de truncamento correto. A interface indica que a saída está incompleta.
Webhooks de tarefa tentam novamente após falhas de entrega
Webhooks de conclusão de tarefa são tentados novamente após uma falha de entrega, para que as notificações não dependam de uma única tentativa.
Solicitações de vídeo sem um preço publicado são rejeitadas
Uma solicitação de vídeo é rejeitada antecipadamente quando sua combinação de tamanho e modo não possui uma taxa publicada, evitando a aceitação a um preço incerto. A referência para vídeo utiliza as mesmas taxas publicadas que o restante do catálogo de vídeos.
Requisições apenas de texto para modelos de visão funcionam normalmente
Uma requisição apenas com texto, enviada a um modelo que também aceita imagens, agora retorna uma resposta de texto normal em vez de um erro.
Limites de taxa curtos são tentados novamente automaticamente
Quando uma requisição atinge um limite de taxa curto e uma nova tentativa é segura, o TokenLab tenta novamente para você, resultando em menos falhas nas requisições.
Um formato de erro para todos os modelos
Erros de todos os modelos usam o mesmo formato de resposta e tipos de erro estáveis, para que você possa tratar falhas em um único lugar.
Solicitações de imagem com tamanho excessivo são rejeitadas antecipadamente
Solicitações de upload de imagem que excedem o tamanho suportado são rejeitadas antes do processamento. Os clientes recebem um erro claro imediatamente, e a solicitação não consome uso.
Veja na prática
Experimente as novidades no catálogo de modelos ou consulte a documentação antes de atualizar uma integração.