Anthropic: Claude Opus 4.8
claude-opus-4-8- Entrada / Saída-70%
- $5.00 / $25.00$1.50 / $7.50
- Contexto
- 1M
- Lançado
- 28 de mai. de 2026
- Saída máxima
- 128K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de promptsRaciocínio
Sobre o Claude Opus 4.8
Claude Opus 4.8 é o modelo de nível Opus da Anthropic lançado em 28 de maio de 2026, posicionado entre o Opus 4.7 e o Opus 5 na linha de produtos. Ele lida com os trabalhos de raciocínio, codificação e agentes de longo prazo mais complexos de sua geração, com pensamento adaptativo, entrada de imagem e uso de ferramentas. A Anthropic o lista como legado e recomenda o Opus 5.5 para novos trabalhos.
Pontos fortes
- Pensamento adaptativo com alto esforço padrão, para que prompts complexos recebam raciocínio sem a necessidade de definir um orçamento de tokens manual.
- Aceita texto e imagens e responde em texto, o que abrange a revisão de capturas de tela e perguntas sobre diagramas em um loop de agente.
- Utiliza o tokenizador introduzido com o Opus 4.7, portanto, as contagens de tokens correspondem mais estreitamente aos modelos Claude posteriores do que o Opus 4.6.
- O Fable 5 recorre a este modelo para solicitações que suas salvaguardas recusam, por isso a Anthropic o trata como o principal modelo geral seguro abaixo do Fable.
Quando usar outro modelo
- O Opus 5 entrega resultados visivelmente melhores nas avaliações reportadas pela Anthropic, portanto, é difícil justificar o 4.8 para novas implementações.
- Seu corte de conhecimento confiável é janeiro de 2026, anterior ao Opus 5.5 e ao Sonnet 5.5.
- A Anthropic o marca como legado, com uma recomendação declarada de migrar para o Opus 5.5.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoMessages APIPOST/v1/messagesFormato da API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-opus-4-8", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Preço
O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.
Especificação padrão
Por 1M Token- Preço oficial
- Entrada $5.00 / Saída $25.00 / Leitura de cache $0.50 / Escrita de cache $6.25
- Preço da TokenLab
- Entrada $1.50 / Saída $7.50 / Leitura de cache $0.15 / Escrita de cache $1.88
- Desconto
- -70%
Leitura de cache
- Preço oficial
- $0.50
- Preço da TokenLab
- $0.15
- Desconto
- -70%
Escrita de cache
- Preço oficial
- $6.25
- Preço da TokenLab
- $1.88
- Desconto
- -70%
Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.
Pesquisa na web
- Preço oficial
- $0.01/busca
- Preço da TokenLab
- $0.003/busca
- Desconto
- -70%
| Preço oficialPor 1M Token | Preço da TokenLabPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $5.00 / Saída $25.00 / Leitura de cache $0.50 / Escrita de cache $6.25 | Entrada $1.50 / Saída $7.50 / Leitura de cache $0.15 / Escrita de cache $1.88 | -70% |
| Preços de cache de prompt | |||
| Leitura de cache | $0.50 | $0.15 | -70% |
| Escrita de cache | $6.25 | $1.88 | -70% |
| Taxas de ferramentasCobrado por chamada, apenas quando o modelo utiliza a ferramenta. | |||
| Pesquisa na web | $0.01/busca | $0.003/busca | -70% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 100,0%
- Requisições em 30 dias
- 100+
- Última atividade
- há 3 dias
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Claude Opus 4.8 no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar claude-opus-4-8 com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Raciocínio
- Visão
Pipelines de agentes existentes
Mantenha um agente de codificação ou pesquisa validado em uma versão de modelo fixa enquanto agenda a migração para o Opus 5.5 e executa novamente suas próprias avaliações.
Destino de fallback
Use-o como o modelo de nova tentativa quando uma solicitação a um modelo Fable for recusada por um classificador de salvaguarda, mas ainda precisar de uma resposta robusta.
Revisão profunda de código
Execute uma revisão longa sobre um diff grande, solicitando riscos classificados, testes ausentes e a menor correção segura para cada um.
Exemplos de prompt
Audite este módulo em busca de condições de corrida e explique cada uma com o entrelaçamento exato que a dispara.
Nossa linha do tempo de incidentes e os logs relevantes seguem abaixo. Escreva uma análise de causa raiz e uma lista de mudanças de acompanhamento.
Planeje uma implementação gradual para substituir esta biblioteca de faturamento, incluindo como confirmar se cada etapa funcionou.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Onde o Claude Opus 4.8 se encaixa entre os modelos Claude?
É o lançamento Opus entre o 4.7 e o Opus 5, lançado em 28 de maio de 2026. Ele visa o trabalho de raciocínio e codificação mais difícil da geração 4.x. A Anthropic agora o lista como legado e aponta o Opus 5.5 como o Opus atual.
O Claude Opus 4.8 suporta pensamento adaptativo?
Sim. O pensamento adaptativo é seu modo de pensamento, e o esforço padrão é alto na API da Anthropic. Reduza o esforço para turnos mais rápidos e baratos, ou aumente-o em tarefas onde um caso de borda não detectado seja custoso.
Devo mudar do Opus 4.8 para o Opus 5.5?
Para novos trabalhos, sim: a Anthropic recomenda o Opus 5.5 e publica um guia de migração para o 4.8. Mantenha o 4.8 apenas onde um pipeline validado dependa de seu comportamento exato, e observe que o 5.5 altera as regras de pensamento e uso de ferramentas.
O Claude Opus 4.8 consegue ler imagens?
Sim. Ele aceita texto e imagens como entrada e retorna texto. Ele não consegue criar imagens, portanto, para geração de imagens, você precisa de um modelo de imagem separado junto com ele.
Quanto custa o Claude Opus 4.8?
No TokenLab, Claude Opus 4.8 custa Entrada $1.50 / Saída $7.50 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Claude Opus 4.8?
O Claude Opus 4.8 aceita até 1.000.000 tokens de contexto e gera até 128.000 tokens por resposta.
Qual endpoint o Claude Opus 4.8 deve usar?
Use https://api.tokenlab.sh/v1/messages para Claude Opus 4.8. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Claude Opus 4.8 suporta?
Claude Opus 4.8 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Claude Opus 4.8
Guias com Claude Opus 4.8
Fontes
Revisado em 2 de out. de 2026