Anthropic: Claude Opus 4.6
claude-opus-4-6- Entrada / Saída-70%
- $5.00 / $25.00$1.50 / $7.50
- Contexto
- 1M
- Saída máxima
- 128K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de promptsRaciocínio
Sobre o Claude Opus 4.6
Claude Opus 4.6 é o modelo de nível Opus da Anthropic de fevereiro de 2026, criado para codificação difícil, planejamento e tarefas longas de agentes. Ele introduziu o pensamento adaptativo com quatro níveis de esforço, compactação de contexto para sessões de longa duração e uma janela de contexto longa na linha Claude 4. Atualmente, é um modelo legado na linha da Anthropic, mantido para fluxos de trabalho já ajustados a ele.
Pontos fortes
- Divide projetos de codificação ambiciosos em etapas concretas e as executa, o que foi citado pelos primeiros testadores no post de lançamento da Anthropic.
- O pensamento adaptativo permite que o modelo decida quando um raciocínio mais profundo vale a pena, com níveis de esforço baixo, médio, alto e máximo para controlar o custo.
- A compactação de contexto resume automaticamente turnos mais antigos, para que sessões longas de agentes não travem quando o histórico aumenta.
- A Anthropic relata resultados líderes no Terminal-Bench 2.0 para codificação agentica e no Humanity's Last Exam no lançamento.
Quando usar outro modelo
- Seu corte de conhecimento confiável é anterior ao Opus 4.7 e modelos posteriores, portanto, frameworks recentes são menos familiares.
- A Anthropic agora o marca como legado e recomenda o Opus 5.5, que apresenta melhor desempenho em fluxos de trabalho atuais.
- A forma de orçamento manual de pensamento estendido está obsoleta neste modelo; planeje com base no pensamento adaptativo e no esforço.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoMessages APIPOST/v1/messagesFormato da API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-opus-4-6", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Preço
O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.
Especificação padrão
Por 1M Token- Preço oficial
- Entrada $5.00 / Saída $25.00 / Leitura de cache $0.50 / Escrita de cache $6.25
- Preço da TokenLab
- Entrada $1.50 / Saída $7.50 / Leitura de cache $0.15 / Escrita de cache $1.88
- Desconto
- -70%
Leitura de cache
- Preço oficial
- $0.50
- Preço da TokenLab
- $0.15
- Desconto
- -70%
Escrita de cache
- Preço oficial
- $6.25
- Preço da TokenLab
- $1.88
- Desconto
- -70%
Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.
Pesquisa na web
- Preço oficial
- $0.01/busca
- Preço da TokenLab
- $0.003/busca
- Desconto
- -70%
| Preço oficialPor 1M Token | Preço da TokenLabPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $5.00 / Saída $25.00 / Leitura de cache $0.50 / Escrita de cache $6.25 | Entrada $1.50 / Saída $7.50 / Leitura de cache $0.15 / Escrita de cache $1.88 | -70% |
| Preços de cache de prompt | |||
| Leitura de cache | $0.50 | $0.15 | -70% |
| Escrita de cache | $6.25 | $1.88 | -70% |
| Taxas de ferramentasCobrado por chamada, apenas quando o modelo utiliza a ferramenta. | |||
| Pesquisa na web | $0.01/busca | $0.003/busca | -70% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 100,0%
- Requisições em 30 dias
- 1K+
- Última atividade
- há 16 horas
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Claude Opus 4.6 no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar claude-opus-4-6 com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Raciocínio
- Visão
Agentes de codificação de várias etapas
Comande um agente de terminal que planeja uma refatoração, edita arquivos, executa a suíte e repara falhas, com esforço máximo reservado para as tarefas mais difíceis.
Sessões de pesquisa de longa duração
Mantenha uma sessão ativa durante várias pesquisas e leituras de documentos enquanto a compactação reduz o histórico anterior em vez de interromper a tarefa.
Trabalho de conhecimento profissional
Redija modelos financeiros, resumos jurídicos e análises onde uma resposta errada custa mais do que a latência extra.
Exemplos de prompt
Planeje uma migração deste serviço Express para Fastify, liste os arquivos afetados em ordem, faça a primeira alteração e execute os testes.
Pesquise nestes três documentos as mudanças no reconhecimento de receita entre os anos e resuma as diferenças com referências de página.
Revise este pull request em busca de bugs de concorrência e classifique os problemas pela probabilidade de cada um atingir a produção.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Em que o Claude Opus 4.6 é bom?
Codificação agentica complexa, planejamento e análise profissional. O post de lançamento da Anthropic relata resultados de topo no Terminal-Bench 2.0, Humanity's Last Exam e BrowseComp, e os primeiros testadores descrevem que ele divide tarefas grandes em etapas e as conclui em vez de parar no meio.
Como o Opus 4.6 é diferente do Opus 4.7?
O Opus 4.7 adiciona entrada de imagem de maior resolução, um nível de esforço xhigh, orçamentos de tarefa e um novo tokenizador, e segue instruções de forma mais literal. O Opus 4.6 é anterior a essas mudanças, portanto, prompts que dependiam de interpretação livre podem se comportar de maneira diferente ao alternar.
O Claude Opus 4.6 suporta pensamento estendido?
Ele suporta pensamento adaptativo, onde o modelo decide quanto raciocinar e você o direciona com o parâmetro de esforço. O modo de pensamento estendido manual mais antigo com um orçamento de tokens está marcado como obsoleto neste modelo.
Ainda vale a pena usar o Claude Opus 4.6?
Use-o quando um pipeline existente estiver validado nele e você ainda não puder executar avaliações novamente. Para novos trabalhos, a Anthropic recomenda migrar para o Opus 5.5, que é o modelo Opus atual e traz melhorias para tarefas longas de codificação e conhecimento.
Quanto custa o Claude Opus 4.6?
No TokenLab, Claude Opus 4.6 custa Entrada $1.50 / Saída $7.50 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Claude Opus 4.6?
O Claude Opus 4.6 aceita até 1.000.000 tokens de contexto e gera até 128.000 tokens por resposta.
Qual endpoint o Claude Opus 4.6 deve usar?
Use https://api.tokenlab.sh/v1/messages para Claude Opus 4.6. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Claude Opus 4.6 suporta?
Claude Opus 4.6 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Claude Opus 4.6
Fontes
Revisado em 2 de out. de 2026