Anthropic: Claude Opus 4.8
claude-opus-4-8- Entrée / Sortie-70%
- $5.00 / $25.00$1.50 / $7.50
- Contexte
- 1M
- Date de sortie
- 28 mai 2026
- Sortie maximale
- 128K
- Modalités
- VisionDiscussion
- Capacités
- Utilisation d'outilsCache de promptsRaisonnement
À propos de Claude Opus 4.8
Claude Opus 4.8 est le modèle de niveau Opus d'Anthropic sorti le 28 mai 2026, se situant entre Opus 4.7 et Opus 5 dans la gamme. Il gère les tâches de raisonnement, de codage et d'agent à long terme les plus complexes de sa génération, avec une réflexion adaptative, une entrée d'image et l'utilisation d'outils. Anthropic le classe comme obsolète (legacy) et recommande Opus 5.5 pour les nouveaux travaux.
Points forts
- Réflexion adaptative avec un effort par défaut élevé, permettant aux invites complexes d'obtenir un raisonnement sans définir manuellement un budget de jetons.
- Accepte du texte et des images et répond en texte, ce qui couvre l'examen de captures d'écran et les questions sur des diagrammes dans une boucle d'agent.
- Utilise le tokenizer introduit avec Opus 4.7, de sorte que le nombre de jetons correspond plus étroitement aux modèles Claude ultérieurs qu'avec Opus 4.6.
- Fable 5 revient à ce modèle pour les requêtes que ses garde-fous refusent ; Anthropic le traite donc comme le meilleur modèle général sécurisé en dessous de Fable.
Quand préférer un autre modèle
- Opus 5 offre des résultats nettement meilleurs selon les évaluations publiées par Anthropic, rendant le 4.8 difficile à justifier pour de nouvelles constructions.
- Sa date limite de connaissances fiable est janvier 2026, antérieure à celle d'Opus 5.5 et de Sonnet 5.5.
- Anthropic le marque comme obsolète, avec une recommandation explicite de migrer vers Opus 5.5.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteMessages APIPOST/v1/messagesFormat d'API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "claude-opus-4-8", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Tarification
Le tarif TokenLab s'applique à Verified pour réduire vos coûts. Le tarif officiel s'applique à la route Official pour une fiabilité optimale. Auto sélectionne la route qui garantit le succès de votre requête.
Spécification par défaut
Par 1M Token- Tarif Official
- Entrée $5.00 / Sortie $25.00 / Lecture cache $0.50 / Jetons d'écriture cache $6.25
- Prix TokenLab
- Entrée $1.50 / Sortie $7.50 / Lecture cache $0.15 / Jetons d'écriture cache $1.88
- Remise
- -70%
Lecture cache
- Tarif Official
- $0.50
- Prix TokenLab
- $0.15
- Remise
- -70%
Jetons d'écriture cache
- Tarif Official
- $6.25
- Prix TokenLab
- $1.88
- Remise
- -70%
Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.
Recherche web
- Tarif Official
- $0.01/recherche
- Prix TokenLab
- $0.003/recherche
- Remise
- -70%
| Tarif OfficialPar 1M Token | Prix TokenLabPar 1M Token | Remise | |
|---|---|---|---|
| Spécification par défaut | Entrée $5.00 / Sortie $25.00 / Lecture cache $0.50 / Jetons d'écriture cache $6.25 | Entrée $1.50 / Sortie $7.50 / Lecture cache $0.15 / Jetons d'écriture cache $1.88 | -70% |
| Tarification du cache de prompt | |||
| Lecture cache | $0.50 | $0.15 | -70% |
| Jetons d'écriture cache | $6.25 | $1.88 | -70% |
| Frais d'outilsFacturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle. | |||
| Recherche web | $0.01/recherche | $0.003/recherche | -70% |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
- Taux de réussite sur 30 jours
- 100,0%
- Requêtes sur 30 jours
- 100+
- Dernière activité
- il y a 3 jours
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez Claude Opus 4.8 dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester claude-opus-4-8 avec un message sur /v1/messages. Affiche la réponse, la latence et le coût.
Cas d'usage
Idéal pour- Raisonnement
- Vision
Pipelines d'agents existants
Maintenez un agent de codage ou de recherche validé sur une version de modèle fixe pendant que vous planifiez le passage à Opus 5.5 et que vous relancez vos propres évaluations.
Cible de repli
Utilisez-le comme modèle de nouvelle tentative lorsqu'une requête adressée à un modèle Fable est refusée par un classificateur de garde-fous mais nécessite tout de même une réponse solide.
Revue de code approfondie
Effectuez une revue longue sur un grand diff, en demandant des risques classés, les tests manquants et le plus petit correctif sûr pour chacun.
Exemples de prompts
Auditez ce module pour détecter les conditions de concurrence et expliquez chacune d'elles avec l'entrelacement exact qui les déclenche.
Voici notre chronologie d'incident et les journaux pertinents. Rédigez une analyse des causes profondes et une liste de changements de suivi.
Planifiez un déploiement par étapes pour remplacer cette bibliothèque de facturation, y compris la manière de confirmer le succès de chaque étape.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
Où se situe Claude Opus 4.8 parmi les modèles Claude ?
Il s'agit de la version Opus entre 4.7 et Opus 5, lancée le 28 mai 2026. Il cible les travaux de raisonnement et de codage les plus complexes de la génération 4.x. Anthropic le classe désormais comme obsolète et indique Opus 5.5 comme l'Opus actuel.
Claude Opus 4.8 prend-il en charge la réflexion adaptative ?
Oui. La réflexion adaptative est son mode de réflexion, et l'effort par défaut est élevé sur l'API d'Anthropic. Réduisez l'effort pour des tours plus rapides et moins coûteux, ou augmentez-le pour les tâches où un cas limite manqué est coûteux.
Dois-je passer d'Opus 4.8 à Opus 5.5 ?
Pour les nouveaux travaux, oui : Anthropic recommande Opus 5.5 et publie un guide de migration pour le 4.8. Ne conservez le 4.8 que là où un pipeline validé dépend de son comportement exact, et notez que le 5.5 modifie les règles de réflexion et d'utilisation des outils.
Claude Opus 4.8 peut-il lire des images ?
Oui. Il prend du texte et des images en entrée et renvoie du texte. Il ne peut pas créer d'images ; pour la génération d'images, vous avez besoin d'un modèle d'image distinct à ses côtés.
Combien coûte Claude Opus 4.8 ?
Sur TokenLab, Claude Opus 4.8 coûte Entrée $1.50 / Sortie $7.50 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de Claude Opus 4.8 ?
Claude Opus 4.8 accepte jusqu'à 1 000 000 jetons de contexte et génère jusqu'à 128 000 jetons par réponse.
Quel endpoint Claude Opus 4.8 doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/messages pour Claude Opus 4.8. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations Claude Opus 4.8 prend-il en charge ?
Claude Opus 4.8 prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer Claude Opus 4.8
Guides utilisant Claude Opus 4.8
Sources
Mis à jour le 2 oct. 2026