Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Anthropic: Claude Sonnet 4.6

Cavalo de batalha Claude para agentes de codificação, análise cuidadosa e controle de custos de produção
Comparar modelos
claude-sonnet-4-6
DisponívelAnthropicChatEntrada em cache 90% mais barata
Entrada / Saída-70%
$3.00 / $15.00$0.90 / $4.50
Contexto
1M
Lançado
17 de fev. de 2026
Saída máxima
128K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de promptsRaciocínio

Sobre o Claude Sonnet 4.6

O Claude Sonnet 4.6 é o modelo de nível intermediário da Anthropic, lançado em fevereiro de 2026 para programação, agentes e trabalho de conhecimento cotidiano. Ele segue instruções de forma mais consistente que o Sonnet 4.5 e opera um computador através de capturas de tela, mouse e teclado quase tão bem quanto o Opus 4.6, mantendo-se na classe de preço do Sonnet. Ele aceita texto e imagens e suporta uso de ferramentas, cache de prompts e raciocínio estendido.

Pontos fortes

  • Trabalho de programação que abrange muitos arquivos: a Anthropic relata que desenvolvedores com acesso antecipado o preferiram ao Sonnet 4.5 por uma larga margem.
  • Uso de computador: ele pontua a uma fração de ponto do Opus 4.6 no OSWorld-Verified, o benchmark relatado pela Anthropic para operação de software de desktop.
  • Execuções longas de agentes que chamam muitas ferramentas, onde a Anthropic relata um ganho claro sobre o Sonnet 4.5 em sua avaliação MCP-Atlas.
  • O raciocínio estendido pode ser aumentado para problemas difíceis e desativado para turnos rápidos e baratos.

Quando usar outro modelo

  • Os modelos Claude da classe Opus continuam sendo a melhor escolha para o raciocínio de várias etapas mais difícil e as tarefas autônomas mais longas.
  • Para classificação, extração e outras chamadas simples de alto volume, o Claude Haiku 4.5 responde mais rápido a uma taxa menor.
  • Ele escreve apenas texto; a saída de imagem, áudio e vídeo requer um modelo separado.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoMessages API
    POST/v1/messages
    Formato da API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-sonnet-4-6",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Preço

O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.

Especificação padrão

Por 1M Token
Preço oficial
Entrada $3.00 / Saída $15.00 / Leitura de cache $0.30 / Escrita de cache $3.75
Preço da TokenLab
Entrada $0.90 / Saída $4.50 / Leitura de cache $0.09 / Escrita de cache $1.13
Desconto
-70%
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.30
Preço da TokenLab
$0.09
Desconto
-70%

Escrita de cache

Preço oficial
$3.75
Preço da TokenLab
$1.13
Desconto
-70%
Taxas de ferramentas

Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.

Pesquisa na web

Preço oficial
$0.01/busca
Preço da TokenLab
$0.003/busca
Desconto
-70%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
Taxa de sucesso em 30 dias
100,0%
Requisições em 30 dias
100+
Última atividade
há 3 dias

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Claude Sonnet 4.6 no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar claude-sonnet-4-6 com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Raciocínio
  • Visão
  • Agentes de programação

    Execute-o por trás de um editor ou agente de terminal para planejar uma alteração, editar vários arquivos, executar os testes e corrigir o que falhou, com menos instruções perdidas do que nas versões anteriores do Sonnet.

  • Automação de uso de computador

    Deixe que ele preencha formulários da web, mova dados entre aplicativos de desktop e confirme o resultado a partir de capturas de tela quando o sistema de destino não tiver API.

  • Revisão de documentos e contratos

    Carregue relatórios longos, contratos ou artigos de pesquisa, peça discrepâncias e riscos, e obtenha respostas que citem as passagens nas quais se baseiam.

  • Assistentes de suporte e operações

    Responda a perguntas de clientes a partir de uma base de conhecimento, chame ferramentas internas para consultar pedidos ou contas e transfira o atendimento de forma limpa quando um humano for necessário.

Exemplos de prompt

Abaixo estão um teste com falha e os três arquivos que ele toca. Encontre a causa, proponha a menor correção e explique o que mais a alteração poderia quebrar.

Leia este contrato de fornecedor de 40 páginas e liste todas as cláusulas que limitam nosso direito de rescisão, com o número da seção e um motivo de uma linha para cada uma.

Você tem ferramentas para pesquisar pedidos e emitir reembolsos. Um cliente diz que o pedido 4417 chegou danificado. Decida o que verificar primeiro e, em seguida, aja.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Em que o Claude Sonnet 4.6 é melhor?

Programação, fluxos de trabalho de agentes e uso de computador. A Anthropic o posiciona como o modelo que a maioria das equipes deve usar por padrão: ele lida bem com alterações de código em vários arquivos e execuções longas de chamadas de ferramentas, e opera software de desktop a partir de capturas de tela com quase a mesma precisão do Opus 4.6. É também um modelo geral sólido para análise, escrita e revisão de documentos.

Como o Claude Sonnet 4.6 é diferente do Claude Opus 4.6?

O Sonnet 4.6 é a camada mais rápida e de menor custo; o Opus 4.6 é o mais capaz. O Sonnet chega perto do Opus em benchmarks de programação e uso de computador, então a maioria das cargas de trabalho de produção começa no Sonnet. Mova uma tarefa para o Opus quando ela precisar de um raciocínio mais profundo em várias etapas ou continuar falhando no Sonnet.

O Claude Sonnet 4.6 suporta raciocínio estendido?

Sim. Você pode permitir que o modelo raciocine antes de responder e controlar quanto esforço ele dedica. Deixe o raciocínio desativado para turnos curtos e sensíveis à latência, e aumente-o para depuração, planejamento ou análise onde uma resposta errada custa mais do que uma mais lenta.

O Claude Sonnet 4.6 consegue ler imagens?

Sim. Ele aceita imagens junto com texto, portanto, pode ler capturas de tela, gráficos, páginas digitalizadas e mock-ups de interface. A mesma entrada de visão é o que permite que ele opere um computador: ele olha para a tela, decide onde clicar ou digitar e confirma o resultado.

Devo atualizar do Claude Sonnet 4.5 para o Sonnet 4.6?

Para cargas de trabalho de programação e agentes, sim. A Anthropic relata melhor seguimento de instruções, menos excesso de engenharia e um grande ganho no uso de computador em relação ao Sonnet 4.5. Prompts escritos para o 4.5 geralmente funcionam; execute novamente seu próprio conjunto de avaliação antes de alternar o tráfego de produção.

Quanto custa o Claude Sonnet 4.6?

No TokenLab, Claude Sonnet 4.6 custa Entrada $0.90 / Saída $4.50 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Claude Sonnet 4.6?

O Claude Sonnet 4.6 aceita até 1.000.000 tokens de contexto e gera até 128.000 tokens por resposta.

Qual endpoint o Claude Sonnet 4.6 deve usar?

Use https://api.tokenlab.sh/v1/messages para Claude Sonnet 4.6. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Claude Sonnet 4.6 suporta?

Claude Sonnet 4.6 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Claude Sonnet 4.6

Guias com Claude Sonnet 4.6

Fontes

Revisado em 2 de out. de 2026

Mais da série Claude 4

Modelos relacionados