Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

Anthropic: Claude Opus 4.8

Niveau Claude Opus supérieur pour le raisonnement le plus complexe, le codage et les agents à long terme
Comparer les modèles
claude-opus-4-8
DisponibleAnthropicDiscussionEntrée en cache : 90% de réductionRécent
Entrée / Sortie-70%
$5.00 / $25.00$1.50 / $7.50
Contexte
1M
Date de sortie
28 mai 2026
Sortie maximale
128K
Modalités
VisionDiscussion
Capacités
Utilisation d'outilsCache de promptsRaisonnement

À propos de Claude Opus 4.8

Claude Opus 4.8 est le modèle de niveau Opus d'Anthropic sorti le 28 mai 2026, se situant entre Opus 4.7 et Opus 5 dans la gamme. Il gère les tâches de raisonnement, de codage et d'agent à long terme les plus complexes de sa génération, avec une réflexion adaptative, une entrée d'image et l'utilisation d'outils. Anthropic le classe comme obsolète (legacy) et recommande Opus 5.5 pour les nouveaux travaux.

Points forts

  • Réflexion adaptative avec un effort par défaut élevé, permettant aux invites complexes d'obtenir un raisonnement sans définir manuellement un budget de jetons.
  • Accepte du texte et des images et répond en texte, ce qui couvre l'examen de captures d'écran et les questions sur des diagrammes dans une boucle d'agent.
  • Utilise le tokenizer introduit avec Opus 4.7, de sorte que le nombre de jetons correspond plus étroitement aux modèles Claude ultérieurs qu'avec Opus 4.6.
  • Fable 5 revient à ce modèle pour les requêtes que ses garde-fous refusent ; Anthropic le traite donc comme le meilleur modèle général sécurisé en dessous de Fable.

Quand préférer un autre modèle

  • Opus 5 offre des résultats nettement meilleurs selon les évaluations publiées par Anthropic, rendant le 4.8 difficile à justifier pour de nouvelles constructions.
  • Sa date limite de connaissances fiable est janvier 2026, antérieure à celle d'Opus 5.5 et de Sonnet 5.5.
  • Anthropic le marque comme obsolète, avec une recommandation explicite de migrer vers Opus 5.5.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteMessages API
    POST/v1/messages
    Format d'API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "claude-opus-4-8",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Tarification

Le tarif TokenLab s'applique à Verified pour réduire vos coûts. Le tarif officiel s'applique à la route Official pour une fiabilité optimale. Auto sélectionne la route qui garantit le succès de votre requête.

Spécification par défaut

Par 1M Token
Tarif Official
Entrée $5.00 / Sortie $25.00 / Lecture cache $0.50 / Jetons d'écriture cache $6.25
Prix TokenLab
Entrée $1.50 / Sortie $7.50 / Lecture cache $0.15 / Jetons d'écriture cache $1.88
Remise
-70%
Tarification du cache de prompt

Lecture cache

Tarif Official
$0.50
Prix TokenLab
$0.15
Remise
-70%

Jetons d'écriture cache

Tarif Official
$6.25
Prix TokenLab
$1.88
Remise
-70%
Frais d'outils

Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.

Recherche web

Tarif Official
$0.01/recherche
Prix TokenLab
$0.003/recherche
Remise
-70%

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Taux de réussite sur 30 jours
100,0%
Requêtes sur 30 jours
100+
Dernière activité
il y a 3 jours

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez Claude Opus 4.8 dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester claude-opus-4-8 avec un message sur /v1/messages. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Raisonnement
  • Vision
  • Pipelines d'agents existants

    Maintenez un agent de codage ou de recherche validé sur une version de modèle fixe pendant que vous planifiez le passage à Opus 5.5 et que vous relancez vos propres évaluations.

  • Cible de repli

    Utilisez-le comme modèle de nouvelle tentative lorsqu'une requête adressée à un modèle Fable est refusée par un classificateur de garde-fous mais nécessite tout de même une réponse solide.

  • Revue de code approfondie

    Effectuez une revue longue sur un grand diff, en demandant des risques classés, les tests manquants et le plus petit correctif sûr pour chacun.

Exemples de prompts

Auditez ce module pour détecter les conditions de concurrence et expliquez chacune d'elles avec l'entrelacement exact qui les déclenche.

Voici notre chronologie d'incident et les journaux pertinents. Rédigez une analyse des causes profondes et une liste de changements de suivi.

Planifiez un déploiement par étapes pour remplacer cette bibliothèque de facturation, y compris la manière de confirmer le succès de chaque étape.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Où se situe Claude Opus 4.8 parmi les modèles Claude ?

Il s'agit de la version Opus entre 4.7 et Opus 5, lancée le 28 mai 2026. Il cible les travaux de raisonnement et de codage les plus complexes de la génération 4.x. Anthropic le classe désormais comme obsolète et indique Opus 5.5 comme l'Opus actuel.

Claude Opus 4.8 prend-il en charge la réflexion adaptative ?

Oui. La réflexion adaptative est son mode de réflexion, et l'effort par défaut est élevé sur l'API d'Anthropic. Réduisez l'effort pour des tours plus rapides et moins coûteux, ou augmentez-le pour les tâches où un cas limite manqué est coûteux.

Dois-je passer d'Opus 4.8 à Opus 5.5 ?

Pour les nouveaux travaux, oui : Anthropic recommande Opus 5.5 et publie un guide de migration pour le 4.8. Ne conservez le 4.8 que là où un pipeline validé dépend de son comportement exact, et notez que le 5.5 modifie les règles de réflexion et d'utilisation des outils.

Claude Opus 4.8 peut-il lire des images ?

Oui. Il prend du texte et des images en entrée et renvoie du texte. Il ne peut pas créer d'images ; pour la génération d'images, vous avez besoin d'un modèle d'image distinct à ses côtés.

Combien coûte Claude Opus 4.8 ?

Sur TokenLab, Claude Opus 4.8 coûte Entrée $1.50 / Sortie $7.50 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de Claude Opus 4.8 ?

Claude Opus 4.8 accepte jusqu'à 1 000 000 jetons de contexte et génère jusqu'à 128 000 jetons par réponse.

Quel endpoint Claude Opus 4.8 doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/messages pour Claude Opus 4.8. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations Claude Opus 4.8 prend-il en charge ?

Claude Opus 4.8 prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer Claude Opus 4.8

Guides utilisant Claude Opus 4.8

Sources

Mis à jour le 2 oct. 2026

Plus de la série Claude 4

Modèles associés