Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

xAI: Grok 4.6

O Grok 4.6 lida com entrada de texto e imagem com chamada de ferramentas e uma grande janela de contexto. Pode trazer documentos de referência e capturas de tela para a mesma conversa de trabalho para análise, escrita ou assistência de software.
Comparar modelos
grok-4.6
DisponívelxAIChatEntrada em cache 75% mais barata
Entrada / Saída-50%
$2.00 / $6.00$1.00 / $3.00
Contexto
500K
Lançado
12 de ago. de 2026
Saída máxima
128K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de prompts

Sobre o Grok 4.6

O Grok 4.6 é o modelo da xAI para programação, trabalho agêntico e tarefas intensivas em conhecimento, lançado entre o Grok 4.5 e o 4.7. Ele lê texto e imagens, escreve texto e oferece esforço de raciocínio de baixo a xalto (xhigh), tendo o alto como padrão. As equipes o utilizam para colocar documentos de referência e capturas de tela em uma única conversa de trabalho para análise, redação ou assistência de software.

Pontos fortes

  • Lida com documentos e capturas de tela na mesma conversa, de modo que um relatório de bug com uma imagem não precisa de pré-processamento separado.
  • O esforço de raciocínio possui quatro níveis, de baixo a xalto (xhigh), com o alto ativado por padrão para perguntas mais difíceis.
  • A chamada de funções (function calling) e as saídas estruturadas tornam-no viável como o motor de um assistente que utiliza ferramentas.
  • Voltado tanto para o trabalho intelectual quanto para códigos, o que se adequa a tarefas de análise e redação longa.
  • O cache de prompts ajuda quando um grande conjunto de referências é reutilizado ao longo de uma sessão.

Quando usar outro modelo

  • O Grok 4.7 o sucedeu como o principal (flagship) da xAI, portanto, o 4.6 atende principalmente a prompts já validados nele.
  • É um modelo de saída em texto; a criação de imagens ou áudio requer um modelo diferente.
  • Configurações de raciocínio pesado aumentam o tempo das respostas, portanto, bate-papos sensíveis à latência podem se beneficiar de um esforço menor ou de um modelo sem raciocínio.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoResponses API
    POST/v1/responses
    Formato da API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.6",
        "input": "Hello!"
      }'

Preço

O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.

Entrada tokens <= 200K

Por 1M Token
Preço oficial
Entrada $2.00 / Saída $6.00 / Leitura de cache $0.50
Preço da TokenLab
Entrada $1.00 / Saída $3.00 / Leitura de cache $0.25
Desconto
-50%

Entrada tokens 200K-500K

Por 1M Token
Preço oficial
Entrada $4.00 / Saída $12.00 / Leitura de cache $1.00
Preço da TokenLab
Entrada $2.00 / Saída $6.00 / Leitura de cache $0.50
Desconto
-50%
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.50
Preço da TokenLab
$0.25
Desconto
-50%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Grok 4.6 no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar grok-4.6 com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Visão
  • Análise de documentos com figuras

    Faça o upload de um relatório junto com seus gráficos como imagens e peça por inconsistências entre a narrativa e os números apresentados.

  • Assistência de software

    Diagnostique uma falha de compilação a partir de logs e de uma captura de tela do erro, propõe um patch e explique a alteração em linguagem simples.

  • Redação de trabalhos intelectuais

    Transforme uma pilha de anotações de reuniões e material de referência em um briefing estruturado, mantendo as afirmações vinculadas às fontes fornecidas.

Exemplos de prompt

Abaixo estão o texto do relatório trimestral e o gráfico de receita. Diga-me onde as afirmações escritas discordam do gráfico.

Este log de CI e a captura de tela mostram a mesma falha. Explique a causa provável e forneça um patch mínimo.

Combine as anotações anexadas em um resumo de uma página para um novo contratado. Marque qualquer declaração que se baseie em uma única anotação.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Para que o Grok 4.6 é usado?

A xAI o construiu para programação, tarefas agênticas e trabalho intelectual. Ele aceita texto e imagens, chama ferramentas, retorna saída estruturada e raciocina com um esforço ajustável. Os usos típicos são assistência de código e análise de documentos com figuras.

Quais são as configurações de raciocínio no Grok 4.6?

O esforço de raciocínio pode ser baixo, médio, alto ou xalto (xhigh), sendo o alto o padrão. Escolha um nível mais inferior para interações rápidas e um mais alto para depuração, planejamento ou análise em que a precisão seja mais importante.

O Grok 4.6 aceita entrada de imagens?

Sim. Texto e imagens são aceitos, e a resposta é em texto. Isso permite que uma única requisição contenha um documento mais capturas de tela do item sobre o qual você está perguntando.

Em que o Grok 4.6 difere do Grok 4.7?

Ambos compartilham os mesmos tipos de entrada, suporte a ferramentas e níveis de esforço. O Grok 4.7 é o lançamento posterior e o modelo de fronteira recomendado pela xAI. Mantenha o 4.6 onde você já tiver ajustado prompts e testado resultados.

Posso obter JSON do Grok 4.6?

Sim. Saídas estruturadas são suportadas, permitindo passar um esquema e receber uma resposta que corresponda a ele. Isso funciona em conjunto com a chamada de ferramentas (function calling) em fluxos de trabalho baseados em ferramentas.

Quanto custa o Grok 4.6?

No TokenLab, Grok 4.6 custa Entrada $1.00 / Saída $3.00 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Grok 4.6?

O Grok 4.6 aceita até 500.000 tokens de contexto e gera até 131.072 tokens por resposta.

Qual endpoint o Grok 4.6 deve usar?

Use https://api.tokenlab.sh/v1/responses para Grok 4.6. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Grok 4.6 suporta?

Grok 4.6 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Grok 4.6

Fontes

Revisado em 2 de out. de 2026

Mais da série Grok 4

Modelos relacionados