Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

Anthropic: Claude Haiku 4.5

Voie Claude rapide pour les agents légers, les tâches de bureau et le chat réactif
Comparer les modèles
claude-haiku-4-5
DisponibleAnthropicDiscussionEntrée en cache : 90% de réduction
Entrée / Sortie-70%
$1.00 / $5.00$0.30 / $1.50
Contexte
200K
Sortie maximale
64K
Modalités
VisionDiscussion
Capacités
Utilisation d'outilsCache de promptsRaisonnement

À propos de Claude Haiku 4.5

Claude Haiku 4.5 est le modèle Claude petit et rapide d'Anthropic, lancé en octobre 2025 pour les travaux à haut volume et sensibles à la latence. Anthropic le décrit comme le modèle le plus rapide de sa gamme avec une intelligence proche de la frontière technologique. Il accepte le texte et les images, prend en charge l'utilisation d'outils et la mise en cache des prompts, et utilise une réflexion étendue manuelle avec un budget de jetons plutôt que la réflexion adaptative des modèles Claude plus récents.

Points forts

  • Latence la plus faible parmi les modèles Claude listés sur la page de présentation d'Anthropic, ce qui convient aux interfaces de chat et aux assistants en temps réel.
  • Lit les images en complément du texte, ce qui lui permet de classer des captures d'écran, des reçus et des graphiques en volume.
  • La réflexion étendue est optionnelle et définie par un budget de jetons explicite ; vous décidez donc pour chaque requête du niveau de raisonnement à payer.
  • Prend en charge l'utilisation d'outils, la sortie JSON structurée et la mise en cache des prompts, ce qui réduit les coûts des prompts système répétés dans les boucles d'agents.

Quand préférer un autre modèle

  • Sa date limite de connaissances est bien antérieure à celle de la génération Claude 5, il est donc moins informé sur les bibliothèques et événements récents.
  • Il possède une fenêtre de contexte et une limite de sortie plus petites que les modèles Opus et Sonnet 5.x, ce qui restreint les tâches portant sur des dépôts entiers ou des livres.
  • Pour les longs cycles de codage autonome ou la planification complexe en plusieurs étapes, un modèle Sonnet ou Opus échoue moins souvent.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteMessages API
    POST/v1/messages
    Format d'API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-haiku-4-5",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Tarification

Le tarif TokenLab s'applique à Verified pour réduire vos coûts. Le tarif officiel s'applique à la route Official pour une fiabilité optimale. Auto sélectionne la route qui garantit le succès de votre requête.

Spécification par défaut

Par 1M Token
Tarif Official
Entrée $1.00 / Sortie $5.00 / Lecture cache $0.10 / Jetons d'écriture cache $1.25
Prix TokenLab
Entrée $0.30 / Sortie $1.50 / Lecture cache $0.03 / Jetons d'écriture cache $0.375
Remise
-70%
Tarification du cache de prompt

Lecture cache

Tarif Official
$0.10
Prix TokenLab
$0.03
Remise
-70%

Jetons d'écriture cache

Tarif Official
$1.25
Prix TokenLab
$0.375
Remise
-70%
Frais d'outils

Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.

Recherche web

Tarif Official
$0.01/recherche
Prix TokenLab
$0.003/recherche
Remise
-70%

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Taux de réussite sur 30 jours
100,0%
Latence médiane sur 7 jours
1 sn=269
Latence P95 sur 7 jours
16,1 sn=269
Requêtes sur 30 jours
100+
Dernière activité
il y a 3 minutes

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez Claude Haiku 4.5 dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester claude-haiku-4-5 avec un message sur /v1/messages. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Raisonnement
  • Vision
  • Chat et support en temps réel

    Intégrez-le derrière un widget client où la vitesse de réponse prime sur la profondeur, avec des appels d'outils pour la recherche de commandes et un transfert humain lorsque la question devient complexe.

  • Classification et extraction

    Étiquetez des tickets, extrayez des champs de factures ou de captures d'écran, et renvoyez un JSON strict pour un pipeline en aval qui s'exécute des milliers de fois par jour.

  • Agents travailleurs secondaires

    Utilisez-le comme travailleur économique dans une configuration multi-agents : un modèle plus large planifie, et plusieurs appels à Haiku recherchent, résument ou vérifient des fichiers en parallèle.

Exemples de prompts

Classez cet e-mail de support comme facturation, bug, demande de fonctionnalité ou autre, et renvoyez un JSON avec l'étiquette et une raison en une phrase.

Résumez cette transcription de chat en trois points clés et listez chaque action à entreprendre avec son responsable.

Regardez cette capture d'écran d'une boîte de dialogue d'erreur et dites-moi quel paramètre l'utilisateur doit modifier.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Pour quel usage Claude Haiku 4.5 est-il le plus adapté ?

Tâches rapides à haut volume : assistants de chat, classification, extraction de données, résumé et agents travailleurs. Anthropic le positionne comme le modèle Claude le plus rapide avec une intelligence proche de la frontière, c'est donc le choix par défaut lorsque le temps de réponse et le débit importent plus qu'un raisonnement approfondi.

Claude Haiku 4.5 prend-il en charge la réflexion étendue ?

Oui, mais sous forme manuelle : vous activez la réflexion et définissez un budget de jetons. Il n'utilise pas le mode de réflexion adaptative ou le paramètre d'effort des modèles Sonnet et Opus plus récents ; vous contrôlez donc la profondeur du raisonnement via le budget que vous allouez.

Claude Haiku 4.5 peut-il traiter des images ?

Oui. Il prend des images en complément du texte et répond en texte. Cela couvre la lecture de captures d'écran, de graphiques et de documents numérisés. Il ne peut ni générer ni modifier des images ; utilisez donc un modèle d'image lorsque vous avez besoin d'une sortie visuelle.

Quand devrais-je passer de Haiku 4.5 à Sonnet ?

Passez à Sonnet lorsque Haiku ne respecte pas les instructions sur des prompts longs, omet des étapes dans des exécutions d'agents multi-outils, ou nécessite des connaissances sur des versions récentes. Sonnet 5.5 est l'étape suivante ; il conserve un profil rapide, avec une fenêtre de contexte plus longue et une date limite de connaissances beaucoup plus récente.

Combien coûte Claude Haiku 4.5 ?

Sur TokenLab, Claude Haiku 4.5 coûte Entrée $0.30 / Sortie $1.50 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de Claude Haiku 4.5 ?

Claude Haiku 4.5 accepte jusqu'à 200 000 jetons de contexte et génère jusqu'à 64 000 jetons par réponse.

Quel endpoint Claude Haiku 4.5 doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/messages pour Claude Haiku 4.5. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations Claude Haiku 4.5 prend-il en charge ?

Claude Haiku 4.5 prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer Claude Haiku 4.5

Guides utilisant Claude Haiku 4.5

Sources

Mis à jour le 2 oct. 2026

Plus de la série Claude 4

Modèles associés