Anthropic: Claude Haiku 4.5
claude-haiku-4-5- Entrada / Salida-70%
- $1.00 / $5.00$0.30 / $1.50
- Contexto
- 200K
- Salida máxima
- 64K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de promptsRazonamiento
Sobre Claude Haiku 4.5
Claude Haiku 4.5 es el modelo Claude pequeño y rápido de Anthropic, lanzado en octubre de 2025 para trabajos de alto volumen y sensibles a la latencia. Anthropic lo describe como el modelo más rápido de su línea con una inteligencia casi de frontera. Acepta texto e imágenes, admite el uso de herramientas y el almacenamiento en caché de prompts, y utiliza pensamiento extendido manual con un presupuesto de tokens en lugar del pensamiento adaptativo de los modelos Claude más nuevos.
Puntos fuertes
- La latencia más baja entre los modelos Claude listados en la página de resumen de Anthropic, lo que se adapta a front-ends de chat y asistentes en tiempo real.
- Lee imágenes junto con texto, por lo que puede clasificar capturas de pantalla, recibos y gráficos en volumen.
- El pensamiento extendido es opcional y se establece con un presupuesto de tokens explícito, por lo que decides por solicitud cuánto razonamiento pagar.
- Admite el uso de herramientas, salida JSON estructurada y almacenamiento en caché de prompts, lo que mantiene los prompts del sistema repetidos a bajo costo en bucles de agentes.
Cuándo buscar otra opción
- Su corte de conocimiento es mucho anterior a la generación Claude 5, por lo que sabe menos sobre bibliotecas y eventos recientes.
- Tiene una ventana de contexto y un límite de salida más pequeños que los modelos Opus y Sonnet 5.x, lo que limita los trabajos de repositorio completo o de longitud de libro.
- Para ejecuciones de codificación autónomas largas o planificación ambigua de varios pasos, un modelo Sonnet u Opus falla con menos frecuencia.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoMessages APIPOST/v1/messagesFormato de API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-haiku-4-5", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Precios
El precio de TokenLab se aplica a Verified, que es más económico en la mayoría de los modelos. El precio oficial corresponde a la tarifa del fabricante y se aplica a la ruta Official, que es más fiable. Auto cobra según la ruta que complete la solicitud.
Especificación por defecto
Por 1M Token- Precio Official
- Entrada $1.00 / Salida $5.00 / Lectura de caché $0.10 / Escritura de caché $1.25
- Precio de TokenLab
- Entrada $0.30 / Salida $1.50 / Lectura de caché $0.03 / Escritura de caché $0.375
- Descuento
- -70%
Lectura de caché
- Precio Official
- $0.10
- Precio de TokenLab
- $0.03
- Descuento
- -70%
Escritura de caché
- Precio Official
- $1.25
- Precio de TokenLab
- $0.375
- Descuento
- -70%
Se cobra por llamada, solo cuando el modelo utiliza la herramienta.
Búsqueda web
- Precio Official
- $0.01/búsqueda
- Precio de TokenLab
- $0.003/búsqueda
- Descuento
- -70%
| Precio OfficialPor 1M Token | Precio de TokenLabPor 1M Token | Descuento | |
|---|---|---|---|
| Especificación por defecto | Entrada $1.00 / Salida $5.00 / Lectura de caché $0.10 / Escritura de caché $1.25 | Entrada $0.30 / Salida $1.50 / Lectura de caché $0.03 / Escritura de caché $0.375 | -70% |
| Precios de caché de prompt | |||
| Lectura de caché | $0.10 | $0.03 | -70% |
| Escritura de caché | $1.25 | $0.375 | -70% |
| Costos de herramientasSe cobra por llamada, solo cuando el modelo utiliza la herramienta. | |||
| Búsqueda web | $0.01/búsqueda | $0.003/búsqueda | -70% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 100,0%
- Latencia mediana 7 días
- 1 sn=269
- Latencia P95 7 días
- 16,1 sn=269
- Solicitudes 30 días
- 100+
- Última actividad
- hace 3 minutos
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Claude Haiku 4.5 en Console con un prompt listo para editar o enviar.
Ayúdame a probar claude-haiku-4-5 con un mensaje breve en /v1/messages. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Razonamiento
- Visión
Chat y soporte en tiempo real
Ponlo detrás de un widget orientado al cliente donde la velocidad de respuesta importa más que la profundidad, con llamadas a herramientas para consultas de pedidos y una transferencia cuando la pregunta se vuelve difícil.
Clasificación y extracción
Etiqueta tickets, extrae campos de facturas o capturas de pantalla y devuelve JSON estricto para una canalización posterior que se ejecuta miles de veces al día.
Trabajadores sub-agentes
Ejecútalo como el trabajador económico en una configuración multi-agente: un modelo más grande planifica, y varias llamadas a Haiku buscan, resumen o verifican archivos en paralelo.
Ejemplos de prompts
Clasifica este correo electrónico de soporte como facturación, error, solicitud de función u otro, y devuelve JSON con la etiqueta y una razón de una sola oración.
Resume esta transcripción de chat en tres puntos y enumera cualquier elemento de acción con su responsable.
Mira esta captura de pantalla de un cuadro de diálogo de error y dime qué configuración debería cambiar el usuario.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Para qué se utiliza mejor Claude Haiku 4.5?
Trabajos rápidos de alto volumen: asistentes de chat, clasificación, extracción de datos, resumen y agentes trabajadores. Anthropic lo posiciona como el modelo Claude más rápido con inteligencia casi de frontera, por lo que es la elección predeterminada cuando el tiempo de respuesta y el rendimiento importan más que el razonamiento más profundo.
¿Claude Haiku 4.5 admite pensamiento extendido?
Sí, pero en la forma manual: habilitas el pensamiento y estableces un presupuesto de tokens. No utiliza el modo de pensamiento adaptativo ni el parámetro de esfuerzo que usan los modelos Sonnet y Opus más nuevos, por lo que controlas la profundidad del razonamiento a través del presupuesto que asignas.
¿Puede Claude Haiku 4.5 procesar imágenes?
Sí. Toma imágenes junto con texto y responde en texto. Eso cubre la lectura de capturas de pantalla, gráficos y documentos escaneados. No puede generar ni editar imágenes, así que usa un modelo de imagen cuando necesites una salida de imagen.
¿Cuándo debería pasar de Haiku 4.5 a Sonnet?
Pásate cuando Haiku pase por alto instrucciones en prompts largos, omita pasos en ejecuciones de agentes con múltiples herramientas o necesite conocimiento de lanzamientos recientes. Sonnet 5.5 es el siguiente paso y mantiene un perfil rápido, con una ventana de contexto más larga y un corte de conocimiento mucho más reciente.
¿Cuánto cuesta Claude Haiku 4.5?
En TokenLab, Claude Haiku 4.5 cuesta Entrada $0.30 / Salida $1.50 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Claude Haiku 4.5?
Claude Haiku 4.5 admite hasta 200.000 tokens de contexto y genera hasta 64.000 tokens por respuesta.
¿Qué endpoint debe usar Claude Haiku 4.5?
Utiliza https://api.tokenlab.sh/v1/messages para Claude Haiku 4.5. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Claude Haiku 4.5?
Claude Haiku 4.5 admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Claude Haiku 4.5
Guías con Claude Haiku 4.5
Fuentes
Revisado el 2 oct 2026