Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Anthropic: Claude Opus 4.8

Nível superior Claude Opus para o raciocínio mais difícil, codificação e agentes de longo prazo
Comparar modelos
claude-opus-4-8
DisponívelAnthropicChatEntrada em cache 90% mais barataNovo
Entrada / Saída-70%
$5.00 / $25.00$1.50 / $7.50
Contexto
1M
Lançado
28 de mai. de 2026
Saída máxima
128K
Modalidades
VisãoChat
Capacidades
Uso de ferramentasCache de promptsRaciocínio

Sobre o Claude Opus 4.8

Claude Opus 4.8 é o modelo de nível Opus da Anthropic lançado em 28 de maio de 2026, posicionado entre o Opus 4.7 e o Opus 5 na linha de produtos. Ele lida com os trabalhos de raciocínio, codificação e agentes de longo prazo mais complexos de sua geração, com pensamento adaptativo, entrada de imagem e uso de ferramentas. A Anthropic o lista como legado e recomenda o Opus 5.5 para novos trabalhos.

Pontos fortes

  • Pensamento adaptativo com alto esforço padrão, para que prompts complexos recebam raciocínio sem a necessidade de definir um orçamento de tokens manual.
  • Aceita texto e imagens e responde em texto, o que abrange a revisão de capturas de tela e perguntas sobre diagramas em um loop de agente.
  • Utiliza o tokenizador introduzido com o Opus 4.7, portanto, as contagens de tokens correspondem mais estreitamente aos modelos Claude posteriores do que o Opus 4.6.
  • O Fable 5 recorre a este modelo para solicitações que suas salvaguardas recusam, por isso a Anthropic o trata como o principal modelo geral seguro abaixo do Fable.

Quando usar outro modelo

  • O Opus 5 entrega resultados visivelmente melhores nas avaliações reportadas pela Anthropic, portanto, é difícil justificar o 4.8 para novas implementações.
  • Seu corte de conhecimento confiável é janeiro de 2026, anterior ao Opus 5.5 e ao Sonnet 5.5.
  • A Anthropic o marca como legado, com uma recomendação declarada de migrar para o Opus 5.5.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoMessages API
    POST/v1/messages
    Formato da API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-opus-4-8",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Preço

O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.

Especificação padrão

Por 1M Token
Preço oficial
Entrada $5.00 / Saída $25.00 / Leitura de cache $0.50 / Escrita de cache $6.25
Preço da TokenLab
Entrada $1.50 / Saída $7.50 / Leitura de cache $0.15 / Escrita de cache $1.88
Desconto
-70%
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.50
Preço da TokenLab
$0.15
Desconto
-70%

Escrita de cache

Preço oficial
$6.25
Preço da TokenLab
$1.88
Desconto
-70%
Taxas de ferramentas

Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.

Pesquisa na web

Preço oficial
$0.01/busca
Preço da TokenLab
$0.003/busca
Desconto
-70%

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
Taxa de sucesso em 30 dias
100,0%
Requisições em 30 dias
100+
Última atividade
há 3 dias

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Claude Opus 4.8 no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar claude-opus-4-8 com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Raciocínio
  • Visão
  • Pipelines de agentes existentes

    Mantenha um agente de codificação ou pesquisa validado em uma versão de modelo fixa enquanto agenda a migração para o Opus 5.5 e executa novamente suas próprias avaliações.

  • Destino de fallback

    Use-o como o modelo de nova tentativa quando uma solicitação a um modelo Fable for recusada por um classificador de salvaguarda, mas ainda precisar de uma resposta robusta.

  • Revisão profunda de código

    Execute uma revisão longa sobre um diff grande, solicitando riscos classificados, testes ausentes e a menor correção segura para cada um.

Exemplos de prompt

Audite este módulo em busca de condições de corrida e explique cada uma com o entrelaçamento exato que a dispara.

Nossa linha do tempo de incidentes e os logs relevantes seguem abaixo. Escreva uma análise de causa raiz e uma lista de mudanças de acompanhamento.

Planeje uma implementação gradual para substituir esta biblioteca de faturamento, incluindo como confirmar se cada etapa funcionou.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Onde o Claude Opus 4.8 se encaixa entre os modelos Claude?

É o lançamento Opus entre o 4.7 e o Opus 5, lançado em 28 de maio de 2026. Ele visa o trabalho de raciocínio e codificação mais difícil da geração 4.x. A Anthropic agora o lista como legado e aponta o Opus 5.5 como o Opus atual.

O Claude Opus 4.8 suporta pensamento adaptativo?

Sim. O pensamento adaptativo é seu modo de pensamento, e o esforço padrão é alto na API da Anthropic. Reduza o esforço para turnos mais rápidos e baratos, ou aumente-o em tarefas onde um caso de borda não detectado seja custoso.

Devo mudar do Opus 4.8 para o Opus 5.5?

Para novos trabalhos, sim: a Anthropic recomenda o Opus 5.5 e publica um guia de migração para o 4.8. Mantenha o 4.8 apenas onde um pipeline validado dependa de seu comportamento exato, e observe que o 5.5 altera as regras de pensamento e uso de ferramentas.

O Claude Opus 4.8 consegue ler imagens?

Sim. Ele aceita texto e imagens como entrada e retorna texto. Ele não consegue criar imagens, portanto, para geração de imagens, você precisa de um modelo de imagem separado junto com ele.

Quanto custa o Claude Opus 4.8?

No TokenLab, Claude Opus 4.8 custa Entrada $1.50 / Saída $7.50 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do Claude Opus 4.8?

O Claude Opus 4.8 aceita até 1.000.000 tokens de contexto e gera até 128.000 tokens por resposta.

Qual endpoint o Claude Opus 4.8 deve usar?

Use https://api.tokenlab.sh/v1/messages para Claude Opus 4.8. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Claude Opus 4.8 suporta?

Claude Opus 4.8 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Claude Opus 4.8

Guias com Claude Opus 4.8

Fontes

Revisado em 2 de out. de 2026

Mais da série Claude 4

Modelos relacionados