Anthropic: Claude Haiku 4.5
claude-haiku-4-5- Entrada / Saída-70%
- $1.00 / $5.00$0.30 / $1.50
- Contexto
- 200K
- Saída máxima
- 64K
- Modalidades
- VisãoChat
- Capacidades
- Uso de ferramentasCache de promptsRaciocínio
Sobre o Claude Haiku 4.5
O Claude Haiku 4.5 é o modelo Claude pequeno e rápido da Anthropic, lançado em outubro de 2025 para trabalhos de alto volume e sensíveis à latência. A Anthropic descreve-o como o modelo mais rápido em sua linha com inteligência de quase fronteira. Ele aceita texto e imagens, suporta uso de ferramentas e cache de prompt, e usa raciocínio estendido manual com um orçamento de tokens em vez do raciocínio adaptativo dos modelos Claude mais novos.
Pontos fortes
- Menor latência entre os modelos Claude listados na página de visão geral da Anthropic, o que é adequado para front-ends de chat e assistentes em tempo real.
- Lê imagens junto com texto, podendo classificar capturas de tela, recibos e gráficos em volume.
- O raciocínio estendido é opcional e definido com um orçamento de tokens explícito, para que você decida por solicitação quanto raciocínio pagar.
- Suporta uso de ferramentas, saída JSON estruturada e cache de prompt, o que mantém prompts de sistema repetidos baratos em loops de agentes.
Quando usar outro modelo
- Seu corte de conhecimento é muito anterior à geração Claude 5, portanto, ele sabe menos sobre bibliotecas e eventos recentes.
- Ele possui uma janela de contexto e um limite de saída menores que os modelos Opus e Sonnet 5.x, o que limita trabalhos de repositórios inteiros ou do tamanho de livros.
- Para execuções de codificação autônoma longas ou planejamento ambíguo de várias etapas, um modelo Sonnet ou Opus falha com menos frequência.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoMessages APIPOST/v1/messagesFormato da API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-4-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Preço
O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.
Especificação padrão
Por 1M Token- Preço oficial
- Entrada $1.00 / Saída $5.00 / Leitura de cache $0.10 / Escrita de cache $1.25
- Preço da TokenLab
- Entrada $0.30 / Saída $1.50 / Leitura de cache $0.03 / Escrita de cache $0.375
- Desconto
- -70%
Leitura de cache
- Preço oficial
- $0.10
- Preço da TokenLab
- $0.03
- Desconto
- -70%
Escrita de cache
- Preço oficial
- $1.25
- Preço da TokenLab
- $0.375
- Desconto
- -70%
Cobrado por chamada, apenas quando o modelo utiliza a ferramenta.
Pesquisa na web
- Preço oficial
- $0.01/busca
- Preço da TokenLab
- $0.003/busca
- Desconto
- -70%
| Preço oficialPor 1M Token | Preço da TokenLabPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $1.00 / Saída $5.00 / Leitura de cache $0.10 / Escrita de cache $1.25 | Entrada $0.30 / Saída $1.50 / Leitura de cache $0.03 / Escrita de cache $0.375 | -70% |
| Preços de cache de prompt | |||
| Leitura de cache | $0.10 | $0.03 | -70% |
| Escrita de cache | $1.25 | $0.375 | -70% |
| Taxas de ferramentasCobrado por chamada, apenas quando o modelo utiliza a ferramenta. | |||
| Pesquisa na web | $0.01/busca | $0.003/busca | -70% |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 100,0%
- Latência mediana em 7 dias
- 916 msn=273
- Latência P95 em 7 dias
- 16 sn=273
- Requisições em 30 dias
- 100+
- Última atividade
- há 15 minutos
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Claude Haiku 4.5 no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar claude-haiku-4-5 com uma mensagem em /v1/messages. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Raciocínio
- Visão
Chat e suporte em tempo real
Coloque-o atrás de um widget voltado para o cliente onde a velocidade de resposta importa mais do que a profundidade, com chamadas de ferramentas para consultas de pedidos e transferência quando a pergunta se torna difícil.
Classificação e extração
Marque tickets, extraia campos de faturas ou capturas de tela e retorne JSON estrito para um pipeline downstream que é executado milhares de vezes por dia.
Trabalhadores sub-agentes
Execute-o como o trabalhador barato em uma configuração multi-agente: um modelo maior planeja, e várias chamadas do Haiku pesquisam, resumem ou verificam arquivos em paralelo.
Exemplos de prompt
Classifique este e-mail de suporte como cobrança, bug, solicitação de recurso ou outro, e retorne JSON com o rótulo e um motivo de uma frase.
Resuma esta transcrição de chat em três tópicos e liste qualquer item de ação com seu responsável.
Olhe para esta captura de tela de uma caixa de diálogo de erro e diga-me qual configuração o usuário deve alterar.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Para que o Claude Haiku 4.5 é mais indicado?
Trabalhos rápidos e de alto volume: assistentes de chat, classificação, extração de dados, sumarização e agentes trabalhadores. A Anthropic o posiciona como o modelo Claude mais rápido com inteligência de quase fronteira, sendo a escolha padrão quando o tempo de resposta e a taxa de transferência importam mais do que o raciocínio mais profundo.
O Claude Haiku 4.5 suporta raciocínio estendido?
Sim, mas na forma manual: você ativa o raciocínio e define um orçamento de tokens. Ele não usa o modo de raciocínio adaptativo ou o parâmetro de esforço que os modelos Sonnet e Opus mais novos usam, portanto, você controla a profundidade do raciocínio através do orçamento que você define.
O Claude Haiku 4.5 pode processar imagens?
Sim. Ele aceita imagens junto com texto e responde em texto. Isso cobre a leitura de capturas de tela, gráficos e documentos digitalizados. Ele não pode gerar ou editar imagens, portanto, use um modelo de imagem quando precisar de saída de imagem.
Quando devo migrar do Haiku 4.5 para o Sonnet?
Migre quando o Haiku perder instruções em prompts longos, pular etapas em execuções de agentes com várias ferramentas ou precisar de conhecimento de lançamentos recentes. O Sonnet 5.5 é o próximo passo e mantém um perfil rápido, com uma janela de contexto maior e um corte de conhecimento muito mais recente.
Quanto custa o Claude Haiku 4.5?
No TokenLab, Claude Haiku 4.5 custa Entrada $0.30 / Saída $1.50 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do Claude Haiku 4.5?
O Claude Haiku 4.5 aceita até 200.000 tokens de contexto e gera até 64.000 tokens por resposta.
Qual endpoint o Claude Haiku 4.5 deve usar?
Use https://api.tokenlab.sh/v1/messages para Claude Haiku 4.5. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Claude Haiku 4.5 suporta?
Claude Haiku 4.5 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Claude Haiku 4.5
Guias com Claude Haiku 4.5
Fontes
Revisado em 2 de out. de 2026