Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

xAI: Grok 4.20 Non-Reasoning

O Grok 4.20 Non-Reasoning fornece a variante de resposta direta da família 4.20. É útil para extração, redação e conversas assistidas por ferramentas onde uma fase separada de raciocínio estendido não é o foco.
Comparar modelos
grok-4.20-non-reasoning
DisponívelxAIChatEntrada em cache 84% mais barata
Entrada / Saída-50%
$1.25 / $2.50$0.625 / $1.25
Contexto
1M
Saída máxima
128K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de prompts

Sobre o Grok 4.20 Non-Reasoning

Grok 4.20 Non-Reasoning é a versão de resposta direta do modelo 4.20 do xAI. Ele ignora a fase de pensamento estendido, respondendo rapidamente a prompts de texto e imagem, sendo adequado para redação, extração e chat auxiliado por ferramentas. O xAI o descreve como combinando estrita aderência ao prompt com uma baixa taxa de alucinação. Escolha as variantes de raciocínio ou multiagente quando um problema exigir análise deliberada.

Pontos fortes

  • Responde sem uma fase de pensamento separada, o que mantém a latência baixa para chat interativo e trabalhos de alto volume.
  • O xAI destaca a estrita aderência ao prompt e uma baixa taxa de alucinação para este modelo, útil quando a saída deve seguir um modelo.
  • Suporta chamada de função e saída JSON estruturada para pipelines de extração e assistentes orientados por ferramentas.
  • Aceita imagens com texto, podendo ler um recibo ou captura de tela e responder em uma única etapa.
  • O cache de prompts ajuda quando muitas solicitações reutilizam as mesmas instruções longas ou texto de referência.

Quando usar outro modelo

  • Sem uma etapa de raciocínio, ele é mais fraco em lógica de múltiplos estágios ou matemática do que o grok-4.20 ou o grok-4.7.
  • Ele não divide o trabalho entre agentes; pesquisas abertas são mais bem atendidas pela variante multiagente.
  • A saída é apenas de texto, sem geração de imagem, áudio ou vídeo.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoResponses API
    POST/v1/responses
    Formato da API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-non-reasoning",
        "input": "Hello!"
      }'

Preço

O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.

Especificação padrão

Por 1M Token
Preço oficial
Entrada $1.25 / Saída $2.50 / Leitura de cache $0.20
Preço da TokenLab
Entrada $0.625 / Saída $1.25 / Leitura de cache $0.10
Desconto
-50%
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.20
Preço da TokenLab
$0.10
Desconto
-50%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Grok 4.20 Non-Reasoning no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar grok-4.20-non-reasoning com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Visão
  • Chat voltado para o cliente

    Responda a perguntas sobre produtos e contas em um tom consistente, chamando funções de busca quando necessário, sem fazer o cliente esperar por uma longa fase de pensamento.

  • Extração de documentos em massa

    Execute milhares de contratos, formulários ou e-mails através de um esquema JSON fixo, confiando na estrita obediência a instruções para manter os campos consistentes.

  • Redação e reescrita

    Produza rascunhos iniciais de e-mails, resumos e notas de lançamento em um formato solicitado, refinando-os com breves instruções de acompanhamento.

Exemplos de prompt

Resuma este tópico de suporte em três marcadores e uma sugestão de resposta. Mantenha a resposta abaixo de 80 palavras e não prometa um reembolso.

Extraia os nomes das partes, a data de vigência e o período de aviso de rescisão deste contrato para o esquema JSON abaixo. Retorne nulo para qualquer coisa ausente.

Reescreva este registro de alterações para clientes não técnicos. Mantenha os cabeçalhos, remova números de chamados internos e use frases simples.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

O que é o Grok 4.20 Non-Reasoning?

É a versão do Grok 4.20 do xAI que responde diretamente em vez de pensar primeiro. Ele lê texto e imagens, escreve texto e suporta chamadas de função e saídas estruturadas. Destina-se a trabalhos rápidos e pesados em instruções, como extração, redação e chat auxiliado por ferramentas.

Quando devo usar o non-reasoning em vez do grok-4.20?

Use-o quando a tarefa for clara e a resposta for principalmente de recuperação, reescrita ou formatação. Ele responde mais cedo do que o ID de raciocínio. Mude para o grok-4.20 quando a resposta exigir várias etapas de análise, como depuração ou planejamento.

O Grok 4.20 Non-Reasoning segue esquemas JSON?

Sim. Ele suporta saídas estruturadas, permitindo fornecer um esquema e receber uma resposta que se ajuste a ele. Combinado com a ênfase do xAI na estrita aderência ao prompt, isso o torna um padrão razoável para tarefas de extração e classificação.

Ele aceita entrada de imagem?

Sim, imagens podem ser enviadas junto com o texto, por exemplo, um formulário fotografado ou uma captura de tela de interface. A resposta é em texto. O modelo não pode criar ou editar imagens.

Ele funciona com um cliente existente no estilo OpenAI?

Sim. O código de cliente existente no estilo OpenAI funciona alterando apenas o nome do modelo, com definições de ferramentas e esquemas JSON enviados nos campos habituais como antes.

Quanto custa o Grok 4.20 Non-Reasoning?

No TokenLab, Grok 4.20 Non-Reasoning custa Entrada $0.625 / Saída $1.25 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Grok 4.20 Non-Reasoning?

O Grok 4.20 Non-Reasoning aceita até 1.000.000 tokens de contexto e gera até 131.072 tokens por resposta.

Qual endpoint o Grok 4.20 Non-Reasoning deve usar?

Use https://api.tokenlab.sh/v1/responses para Grok 4.20 Non-Reasoning. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Grok 4.20 Non-Reasoning suporta?

Grok 4.20 Non-Reasoning suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Grok 4.20 Non-Reasoning

Fontes

Revisado em 2 de out. de 2026

Mais da série Grok 4

Modelos relacionados