Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

OpenAI: GPT-5 mini

Petit GPT-5 pour les agents réactifs, l'aide au codage et l'automatisation quotidienne
Comparer les modèles
gpt-5-mini
DisponibleOpenAIDiscussionEntrée en cache : 90% de réduction
Entrée / Sortie-30%
$0.25 / $2.00$0.175 / $1.40
Contexte
400K
Sortie maximale
128K
Modalités
VisionDiscussion
Capacités
Utilisation d'outilsCache de promptsRaisonnement

À propos de GPT-5 mini

GPT-5 mini est le modèle GPT-5 plus petit d'OpenAI, décrit comme une version plus rapide et plus rentable de GPT-5 pour un travail bien défini à haut débit. Il accepte du texte et des images, renvoie du texte et conserve les jetons de raisonnement, l'appel de fonctions et les sorties structurées. Choisissez-le plutôt que le modèle complet lorsque la latence et le volume importent plus que la précision maximale.

Points forts

  • Positionné par OpenAI comme la version plus rapide de GPT-5 pour les applications sensibles au temps et à haut débit.
  • Conserve les jetons de raisonnement, il peut donc toujours résoudre des problèmes à étapes multiples à plus petite échelle.
  • Gère l'appel de fonctions, la recherche Web, la recherche de fichiers et les sorties structurées comme son grand frère.
  • Accepte des images en entrée, ce qui permet de poser des questions sur des captures d'écran et des documents sans modèle de vision séparé.

Quand préférer un autre modèle

  • Sa coupure des connaissances de mai 2024 est antérieure à celle du GPT-5 complet, il est donc moins informé sur les événements récents.
  • Pour les raisonnements les plus complexes et les refontes importantes, le GPT-5 complet ou un niveau Pro est le choix le plus sûr.
  • Il renvoie uniquement du texte, sans sortie audio ou image.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteResponses API
    POST/v1/responses
    Format d'API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

Tarification

Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.

Spécification par défaut

Par 1M Token
Prix Official
Entrée $0.25 / Sortie $2.00 / Lecture cache $0.025
Prix Verified
Entrée $0.175 / Sortie $1.40 / Lecture cache $0.0175
Remise
-30%
Tarification du cache de prompt

Lecture cache

Prix Official
$0.025
Prix Verified
$0.0175
Remise
-30%
Frais d'outils

Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.

Recherche web

Prix Official
$0.01/recherche
Prix Verified
$0.007/recherche
Remise
-30%

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez GPT-5 mini dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester gpt-5-mini avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Raisonnement
  • Vision
  • Assistants orientés client

    Répondre aux questions sur les produits avec des appels d'outils vers un système de commande où le temps de réponse façonne l'expérience.

  • Classification par lots

    Étiqueter des milliers de tickets ou d'avis avec un schéma de sortie structuré et des catégories cohérentes.

  • Explication de code et petites modifications

    Expliquer des fonctions, écrire des tests et effectuer des modifications contenues lorsqu'un modèle pleine taille est superflu pour la tâche.

  • Sous-étapes d'agent

    Exécuter des recherches et des résumés de routine au sein d'un flux de travail plus large pendant qu'un modèle plus puissant gère la planification.

Exemples de prompts

Classifiez ce ticket de support comme facturation, bug ou demande de fonctionnalité et renvoyez l'étiquette avec une phrase de justification.

Résumez cette transcription d'appel en cinq points et listez les éventuelles actions à entreprendre avec leurs responsables.

Écrivez des tests unitaires pour cette fonction et indiquez toute entrée qu'elle ne parvient pas à gérer.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Qu'est-ce que GPT-5 mini ?

GPT-5 mini est une version plus petite de GPT-5 d'OpenAI. Il est destiné à un travail rapide et économique avec un volume de requêtes élevé, et il prend toujours en charge le raisonnement, les outils et l'entrée d'images.

Quand dois-je utiliser GPT-5 mini au lieu de GPT-5 ?

Utilisez mini pour des tâches bien définies telles que la classification, la synthèse et les appels d'outils de routine où la vitesse et le volume comptent. Utilisez le GPT-5 complet lorsque les réponses sont trop souvent erronées sur votre propre ensemble d'évaluation ou que la tâche nécessite un raisonnement plus approfondi.

GPT-5 mini accepte-t-il les images ?

Oui. Du texte et des images entrent et du texte sort. Cela couvre la lecture de captures d'écran, de formulaires et de graphiques pour des questions ou de l'extraction, mais le modèle ne peut pas créer ou modifier des images lui-même.

Quelle est la coupure des connaissances de GPT-5 mini ?

OpenAI indique le 31 mai 2024 comme date de coupure des connaissances pour ce modèle. Tout ce qui est plus récent doit provenir du prompt, de fichiers joints ou d'un appel d'outil de recherche Web.

GPT-5 mini est-il plus petit que GPT-5 nano ?

Non. Nano est le plus petit et le moins cher des deux et est destiné à la synthèse et à la classification. Mini se situe entre nano et le GPT-5 complet en termes de capacité et de coût.

Combien coûte GPT-5 mini ?

Sur TokenLab, GPT-5 mini coûte Entrée $0.175 / Sortie $1.40 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de GPT-5 mini ?

GPT-5 mini accepte jusqu'à 400 000 jetons de contexte et génère jusqu'à 128 000 jetons par réponse.

Quel endpoint GPT-5 mini doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/responses pour GPT-5 mini. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations GPT-5 mini prend-il en charge ?

GPT-5 mini prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer GPT-5 mini

Sources

Mis à jour le 2 oct. 2026

Plus de la série GPT 5

Modèles associés