OpenAI: GPT-5 mini
gpt-5-mini- Entrée / Sortie-30%
- $0.25 / $2.00$0.175 / $1.40
- Contexte
- 400K
- Sortie maximale
- 128K
- Modalités
- VisionDiscussion
- Capacités
- Utilisation d'outilsCache de promptsRaisonnement
À propos de GPT-5 mini
GPT-5 mini est le modèle GPT-5 plus petit d'OpenAI, décrit comme une version plus rapide et plus rentable de GPT-5 pour un travail bien défini à haut débit. Il accepte du texte et des images, renvoie du texte et conserve les jetons de raisonnement, l'appel de fonctions et les sorties structurées. Choisissez-le plutôt que le modèle complet lorsque la latence et le volume importent plus que la précision maximale.
Points forts
- Positionné par OpenAI comme la version plus rapide de GPT-5 pour les applications sensibles au temps et à haut débit.
- Conserve les jetons de raisonnement, il peut donc toujours résoudre des problèmes à étapes multiples à plus petite échelle.
- Gère l'appel de fonctions, la recherche Web, la recherche de fichiers et les sorties structurées comme son grand frère.
- Accepte des images en entrée, ce qui permet de poser des questions sur des captures d'écran et des documents sans modèle de vision séparé.
Quand préférer un autre modèle
- Sa coupure des connaissances de mai 2024 est antérieure à celle du GPT-5 complet, il est donc moins informé sur les événements récents.
- Pour les raisonnements les plus complexes et les refontes importantes, le GPT-5 complet ou un niveau Pro est le choix le plus sûr.
- Il renvoie uniquement du texte, sans sortie audio ou image.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Texte vers texteResponses APIPOST/v1/responsesFormat d'API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
Tarification
Le prix Verified s’applique à Verified, moins cher sur la plupart des modèles. Le prix Official est le prix publié par le fabricant du modèle et s’applique à la route Official, plus fiable. Auto facture la route qui termine la requête.
Spécification par défaut
Par 1M Token- Prix Official
- Entrée $0.25 / Sortie $2.00 / Lecture cache $0.025
- Prix Verified
- Entrée $0.175 / Sortie $1.40 / Lecture cache $0.0175
- Remise
- -30%
Lecture cache
- Prix Official
- $0.025
- Prix Verified
- $0.0175
- Remise
- -30%
Facturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle.
Recherche web
- Prix Official
- $0.01/recherche
- Prix Verified
- $0.007/recherche
- Remise
- -30%
| Prix OfficialPar 1M Token | Prix VerifiedPar 1M Token | Remise | |
|---|---|---|---|
| Spécification par défaut | Entrée $0.25 / Sortie $2.00 / Lecture cache $0.025 | Entrée $0.175 / Sortie $1.40 / Lecture cache $0.0175 | -30% |
| Tarification du cache de prompt | |||
| Lecture cache | $0.025 | $0.0175 | -30% |
| Frais d'outilsFacturation à l'appel, uniquement lors de l'utilisation de l'outil par le modèle. | |||
| Recherche web | $0.01/recherche | $0.007/recherche | -30% |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez GPT-5 mini dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à tester gpt-5-mini avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.
Cas d'usage
Idéal pour- Raisonnement
- Vision
Assistants orientés client
Répondre aux questions sur les produits avec des appels d'outils vers un système de commande où le temps de réponse façonne l'expérience.
Classification par lots
Étiqueter des milliers de tickets ou d'avis avec un schéma de sortie structuré et des catégories cohérentes.
Explication de code et petites modifications
Expliquer des fonctions, écrire des tests et effectuer des modifications contenues lorsqu'un modèle pleine taille est superflu pour la tâche.
Sous-étapes d'agent
Exécuter des recherches et des résumés de routine au sein d'un flux de travail plus large pendant qu'un modèle plus puissant gère la planification.
Exemples de prompts
Classifiez ce ticket de support comme facturation, bug ou demande de fonctionnalité et renvoyez l'étiquette avec une phrase de justification.
Résumez cette transcription d'appel en cinq points et listez les éventuelles actions à entreprendre avec leurs responsables.
Écrivez des tests unitaires pour cette fonction et indiquez toute entrée qu'elle ne parvient pas à gérer.
Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.
FAQ
Qu'est-ce que GPT-5 mini ?
GPT-5 mini est une version plus petite de GPT-5 d'OpenAI. Il est destiné à un travail rapide et économique avec un volume de requêtes élevé, et il prend toujours en charge le raisonnement, les outils et l'entrée d'images.
Quand dois-je utiliser GPT-5 mini au lieu de GPT-5 ?
Utilisez mini pour des tâches bien définies telles que la classification, la synthèse et les appels d'outils de routine où la vitesse et le volume comptent. Utilisez le GPT-5 complet lorsque les réponses sont trop souvent erronées sur votre propre ensemble d'évaluation ou que la tâche nécessite un raisonnement plus approfondi.
GPT-5 mini accepte-t-il les images ?
Oui. Du texte et des images entrent et du texte sort. Cela couvre la lecture de captures d'écran, de formulaires et de graphiques pour des questions ou de l'extraction, mais le modèle ne peut pas créer ou modifier des images lui-même.
Quelle est la coupure des connaissances de GPT-5 mini ?
OpenAI indique le 31 mai 2024 comme date de coupure des connaissances pour ce modèle. Tout ce qui est plus récent doit provenir du prompt, de fichiers joints ou d'un appel d'outil de recherche Web.
GPT-5 mini est-il plus petit que GPT-5 nano ?
Non. Nano est le plus petit et le moins cher des deux et est destiné à la synthèse et à la classification. Mini se situe entre nano et le GPT-5 complet en termes de capacité et de coût.
Combien coûte GPT-5 mini ?
Sur TokenLab, GPT-5 mini coûte Entrée $0.175 / Sortie $1.40 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quelles sont les limites de contexte et de sortie de GPT-5 mini ?
GPT-5 mini accepte jusqu'à 400 000 jetons de contexte et génère jusqu'à 128 000 jetons par réponse.
Quel endpoint GPT-5 mini doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/responses pour GPT-5 mini. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations GPT-5 mini prend-il en charge ?
GPT-5 mini prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer GPT-5 mini
Sources
Mis à jour le 2 oct. 2026