Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Anthropic: Claude Haiku 4.5

Carril rápido de Claude para agentes ligeros, tareas de oficina y chat receptivo
Comparar modelos
claude-haiku-4-5
DisponibleAnthropicChatEntrada en caché 90% más barata
Entrada / Salida-70%
$1.00 / $5.00$0.30 / $1.50
Contexto
200K
Salida máxima
64K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de promptsRazonamiento

Sobre Claude Haiku 4.5

Claude Haiku 4.5 es el modelo Claude pequeño y rápido de Anthropic, lanzado en octubre de 2025 para trabajos de alto volumen y sensibles a la latencia. Anthropic lo describe como el modelo más rápido de su línea con una inteligencia casi de frontera. Acepta texto e imágenes, admite el uso de herramientas y el almacenamiento en caché de prompts, y utiliza pensamiento extendido manual con un presupuesto de tokens en lugar del pensamiento adaptativo de los modelos Claude más nuevos.

Puntos fuertes

  • La latencia más baja entre los modelos Claude listados en la página de resumen de Anthropic, lo que se adapta a front-ends de chat y asistentes en tiempo real.
  • Lee imágenes junto con texto, por lo que puede clasificar capturas de pantalla, recibos y gráficos en volumen.
  • El pensamiento extendido es opcional y se establece con un presupuesto de tokens explícito, por lo que decides por solicitud cuánto razonamiento pagar.
  • Admite el uso de herramientas, salida JSON estructurada y almacenamiento en caché de prompts, lo que mantiene los prompts del sistema repetidos a bajo costo en bucles de agentes.

Cuándo buscar otra opción

  • Su corte de conocimiento es mucho anterior a la generación Claude 5, por lo que sabe menos sobre bibliotecas y eventos recientes.
  • Tiene una ventana de contexto y un límite de salida más pequeños que los modelos Opus y Sonnet 5.x, lo que limita los trabajos de repositorio completo o de longitud de libro.
  • Para ejecuciones de codificación autónomas largas o planificación ambigua de varios pasos, un modelo Sonnet u Opus falla con menos frecuencia.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoMessages API
    POST/v1/messages
    Formato de API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-4-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Precios

El precio de TokenLab se aplica a Verified, que es más económico en la mayoría de los modelos. El precio oficial corresponde a la tarifa del fabricante y se aplica a la ruta Official, que es más fiable. Auto cobra según la ruta que complete la solicitud.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $1.00 / Salida $5.00 / Lectura de caché $0.10 / Escritura de caché $1.25
Precio de TokenLab
Entrada $0.30 / Salida $1.50 / Lectura de caché $0.03 / Escritura de caché $0.375
Descuento
-70%
Precios de caché de prompt

Lectura de caché

Precio Official
$0.10
Precio de TokenLab
$0.03
Descuento
-70%

Escritura de caché

Precio Official
$1.25
Precio de TokenLab
$0.375
Descuento
-70%
Costos de herramientas

Se cobra por llamada, solo cuando el modelo utiliza la herramienta.

Búsqueda web

Precio Official
$0.01/búsqueda
Precio de TokenLab
$0.003/búsqueda
Descuento
-70%

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
100,0%
Latencia mediana 7 días
1 sn=269
Latencia P95 7 días
16,1 sn=269
Solicitudes 30 días
100+
Última actividad
hace 3 minutos

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Claude Haiku 4.5 en Console con un prompt listo para editar o enviar.

Ayúdame a probar claude-haiku-4-5 con un mensaje breve en /v1/messages. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Razonamiento
  • Visión
  • Chat y soporte en tiempo real

    Ponlo detrás de un widget orientado al cliente donde la velocidad de respuesta importa más que la profundidad, con llamadas a herramientas para consultas de pedidos y una transferencia cuando la pregunta se vuelve difícil.

  • Clasificación y extracción

    Etiqueta tickets, extrae campos de facturas o capturas de pantalla y devuelve JSON estricto para una canalización posterior que se ejecuta miles de veces al día.

  • Trabajadores sub-agentes

    Ejecútalo como el trabajador económico en una configuración multi-agente: un modelo más grande planifica, y varias llamadas a Haiku buscan, resumen o verifican archivos en paralelo.

Ejemplos de prompts

Clasifica este correo electrónico de soporte como facturación, error, solicitud de función u otro, y devuelve JSON con la etiqueta y una razón de una sola oración.

Resume esta transcripción de chat en tres puntos y enumera cualquier elemento de acción con su responsable.

Mira esta captura de pantalla de un cuadro de diálogo de error y dime qué configuración debería cambiar el usuario.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Para qué se utiliza mejor Claude Haiku 4.5?

Trabajos rápidos de alto volumen: asistentes de chat, clasificación, extracción de datos, resumen y agentes trabajadores. Anthropic lo posiciona como el modelo Claude más rápido con inteligencia casi de frontera, por lo que es la elección predeterminada cuando el tiempo de respuesta y el rendimiento importan más que el razonamiento más profundo.

¿Claude Haiku 4.5 admite pensamiento extendido?

Sí, pero en la forma manual: habilitas el pensamiento y estableces un presupuesto de tokens. No utiliza el modo de pensamiento adaptativo ni el parámetro de esfuerzo que usan los modelos Sonnet y Opus más nuevos, por lo que controlas la profundidad del razonamiento a través del presupuesto que asignas.

¿Puede Claude Haiku 4.5 procesar imágenes?

Sí. Toma imágenes junto con texto y responde en texto. Eso cubre la lectura de capturas de pantalla, gráficos y documentos escaneados. No puede generar ni editar imágenes, así que usa un modelo de imagen cuando necesites una salida de imagen.

¿Cuándo debería pasar de Haiku 4.5 a Sonnet?

Pásate cuando Haiku pase por alto instrucciones en prompts largos, omita pasos en ejecuciones de agentes con múltiples herramientas o necesite conocimiento de lanzamientos recientes. Sonnet 5.5 es el siguiente paso y mantiene un perfil rápido, con una ventana de contexto más larga y un corte de conocimiento mucho más reciente.

¿Cuánto cuesta Claude Haiku 4.5?

En TokenLab, Claude Haiku 4.5 cuesta Entrada $0.30 / Salida $1.50 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Claude Haiku 4.5?

Claude Haiku 4.5 admite hasta 200.000 tokens de contexto y genera hasta 64.000 tokens por respuesta.

¿Qué endpoint debe usar Claude Haiku 4.5?

Utiliza https://api.tokenlab.sh/v1/messages para Claude Haiku 4.5. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Claude Haiku 4.5?

Claude Haiku 4.5 admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Claude Haiku 4.5

Guías con Claude Haiku 4.5

Fuentes

Revisado el 2 oct 2026

Más de Claude 4

Modelos relacionados