xAI: Grok 4.6
grok-4.6- Entrada / Saída-50%
- $2.00 / $6.00$1.00 / $3.00
- Contexto
- 500K
- Lançado
- 12 de ago. de 2026
- Saída máxima
- 128K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de prompts
Sobre o Grok 4.6
O Grok 4.6 é o modelo da xAI para programação, trabalho agêntico e tarefas intensivas em conhecimento, lançado entre o Grok 4.5 e o 4.7. Ele lê texto e imagens, escreve texto e oferece esforço de raciocínio de baixo a xalto (xhigh), tendo o alto como padrão. As equipes o utilizam para colocar documentos de referência e capturas de tela em uma única conversa de trabalho para análise, redação ou assistência de software.
Pontos fortes
- Lida com documentos e capturas de tela na mesma conversa, de modo que um relatório de bug com uma imagem não precisa de pré-processamento separado.
- O esforço de raciocínio possui quatro níveis, de baixo a xalto (xhigh), com o alto ativado por padrão para perguntas mais difíceis.
- A chamada de funções (function calling) e as saídas estruturadas tornam-no viável como o motor de um assistente que utiliza ferramentas.
- Voltado tanto para o trabalho intelectual quanto para códigos, o que se adequa a tarefas de análise e redação longa.
- O cache de prompts ajuda quando um grande conjunto de referências é reutilizado ao longo de uma sessão.
Quando usar outro modelo
- O Grok 4.7 o sucedeu como o principal (flagship) da xAI, portanto, o 4.6 atende principalmente a prompts já validados nele.
- É um modelo de saída em texto; a criação de imagens ou áudio requer um modelo diferente.
- Configurações de raciocínio pesado aumentam o tempo das respostas, portanto, bate-papos sensíveis à latência podem se beneficiar de um esforço menor ou de um modelo sem raciocínio.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoResponses APIPOST/v1/responsesFormato da API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.6", "input": "Hello!" }'
Preço
O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.
Entrada tokens <= 200K
Por 1M Token- Preço oficial
- Entrada $2.00 / Saída $6.00 / Leitura de cache $0.50
- Preço da TokenLab
- Entrada $1.00 / Saída $3.00 / Leitura de cache $0.25
- Desconto
- -50%
Entrada tokens 200K-500K
Por 1M Token- Preço oficial
- Entrada $4.00 / Saída $12.00 / Leitura de cache $1.00
- Preço da TokenLab
- Entrada $2.00 / Saída $6.00 / Leitura de cache $0.50
- Desconto
- -50%
Leitura de cache
- Preço oficial
- $0.50
- Preço da TokenLab
- $0.25
- Desconto
- -50%
| Preço oficialPor 1M Token | Preço da TokenLabPor 1M Token | Desconto | |
|---|---|---|---|
| Entrada tokens <= 200K | Entrada $2.00 / Saída $6.00 / Leitura de cache $0.50 | Entrada $1.00 / Saída $3.00 / Leitura de cache $0.25 | -50% |
| Entrada tokens 200K-500K | Entrada $4.00 / Saída $12.00 / Leitura de cache $1.00 | Entrada $2.00 / Saída $6.00 / Leitura de cache $0.50 | -50% |
| Preços de cache de prompt | |||
| Leitura de cache | $0.50 | $0.25 | -50% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Grok 4.6 no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar grok-4.6 com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Visão
Análise de documentos com figuras
Faça o upload de um relatório junto com seus gráficos como imagens e peça por inconsistências entre a narrativa e os números apresentados.
Assistência de software
Diagnostique uma falha de compilação a partir de logs e de uma captura de tela do erro, propõe um patch e explique a alteração em linguagem simples.
Redação de trabalhos intelectuais
Transforme uma pilha de anotações de reuniões e material de referência em um briefing estruturado, mantendo as afirmações vinculadas às fontes fornecidas.
Exemplos de prompt
Abaixo estão o texto do relatório trimestral e o gráfico de receita. Diga-me onde as afirmações escritas discordam do gráfico.
Este log de CI e a captura de tela mostram a mesma falha. Explique a causa provável e forneça um patch mínimo.
Combine as anotações anexadas em um resumo de uma página para um novo contratado. Marque qualquer declaração que se baseie em uma única anotação.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Para que o Grok 4.6 é usado?
A xAI o construiu para programação, tarefas agênticas e trabalho intelectual. Ele aceita texto e imagens, chama ferramentas, retorna saída estruturada e raciocina com um esforço ajustável. Os usos típicos são assistência de código e análise de documentos com figuras.
Quais são as configurações de raciocínio no Grok 4.6?
O esforço de raciocínio pode ser baixo, médio, alto ou xalto (xhigh), sendo o alto o padrão. Escolha um nível mais inferior para interações rápidas e um mais alto para depuração, planejamento ou análise em que a precisão seja mais importante.
O Grok 4.6 aceita entrada de imagens?
Sim. Texto e imagens são aceitos, e a resposta é em texto. Isso permite que uma única requisição contenha um documento mais capturas de tela do item sobre o qual você está perguntando.
Em que o Grok 4.6 difere do Grok 4.7?
Ambos compartilham os mesmos tipos de entrada, suporte a ferramentas e níveis de esforço. O Grok 4.7 é o lançamento posterior e o modelo de fronteira recomendado pela xAI. Mantenha o 4.6 onde você já tiver ajustado prompts e testado resultados.
Posso obter JSON do Grok 4.6?
Sim. Saídas estruturadas são suportadas, permitindo passar um esquema e receber uma resposta que corresponda a ele. Isso funciona em conjunto com a chamada de ferramentas (function calling) em fluxos de trabalho baseados em ferramentas.
Quanto custa o Grok 4.6?
No TokenLab, Grok 4.6 custa Entrada $1.00 / Saída $3.00 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Grok 4.6?
O Grok 4.6 aceita até 500.000 tokens de contexto e gera até 131.072 tokens por resposta.
Qual endpoint o Grok 4.6 deve usar?
Use https://api.tokenlab.sh/v1/responses para Grok 4.6. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Grok 4.6 suporta?
Grok 4.6 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Grok 4.6
Fontes
Revisado em 2 de out. de 2026