MiniMax: MiniMax H3
hailuo-h3- Prix
- À partir de $0.08
- Modalités
- Vidéo
À propos de MiniMax H3
MiniMax H3, également appelé Hailuo H3, est le modèle vidéo multimodal polyvalent de MiniMax et le successeur de Hailuo 2.3. Il génère des vidéos à partir de texte, d'une image fixe, d'une paire d'images de début et de fin, ou d'un ensemble d'images, de vidéos et de clips audio de référence. Il propose des résolutions de 768p et 2K, la gamme supérieure de la famille H3, ce qui le distingue du modèle H3-Max axé sur la vitesse.
Points forts
- La génération à partir d'images de début et de fin permet de fixer le début et la fin d'un plan, ce qui est utile pour transformer un storyboard en mouvement.
- La génération par référence accepte des images, de courts clips vidéo et des clips audio comme guides pour le sujet, le mouvement et le son.
- Les options de résolution sont 768p et 2K ; l'option 2K est supérieure à celle du H3-Max, qui est limité à 768p.
- La génération texte-vidéo et image-vidéo est disponible, permettant à un seul modèle de couvrir les travaux basés uniquement sur des prompts ou sur des images fixes.
- Les clips durent six ou dix secondes, une durée suffisante pour un plan unique avec un début et une fin clairs.
Quand préférer un autre modèle
- Le mode référence et le mode première/dernière image ne peuvent pas être combinés dans une même requête ; vous devez donc choisir entre les deux pour chaque génération.
- Pour une itération rapide à plus basse résolution, MiniMax positionne le H3-Max comme la variante la plus rapide.
- Le rapport d'aspect est limité au 16:9 et est adaptatif ; aucun autre rapport fixe n'est sélectionnable.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
Image vers vidéoRéférence vers vidéoImages de début et fin vers vidéoTexte vers vidéoEndpoint TokenLabPOST/v1/videos/generationscurl -X POST "https://api.tokenlab.sh/v1/videos/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "aspect_ratio": "16:9", "duration": 6, "operation": "text-to-video", "resolution": "768p", "model": "hailuo-h3", "prompt": "Cinematic sunrise over a calm lake with gentle camera motion." }'
Tarification
Le tarif TokenLab s'applique à Verified pour réduire vos coûts. Le tarif officiel s'applique à la route Official pour une fiabilité optimale. Auto sélectionne la route qui garantit le succès de votre requête.
- Image vers vidéoOfficial
- Référence vers vidéoOfficial
- Images de début et fin vers vidéoOfficial
- Texte vers vidéoVerified, Official
Texte vers vidéo · 768p
par seconde- Tarif Official
- $0.08
- Prix TokenLab
- $0.08
- Remise
- —
Image vers vidéo / Images de début et fin vers vidéo / Référence vers vidéo · 768p
par seconde- Tarif Official
- $0.08
- Prix TokenLab
- —
- Remise
- —
Texte vers vidéo · 2k
par seconde- Tarif Official
- $0.13
- Prix TokenLab
- $0.13
- Remise
- —
Image vers vidéo / Images de début et fin vers vidéo / Référence vers vidéo · 2k
par seconde- Tarif Official
- $0.13
- Prix TokenLab
- —
- Remise
- —
Référence vers vidéo · Entrée image · Les 5 premières images sont gratuites
par seconde- Tarif Official
- $0.04/image
- Prix TokenLab
- —
- Remise
- —
| Tarif Officialpar seconde | Prix TokenLabpar seconde | Remise | |
|---|---|---|---|
| Texte vers vidéo · 768p | $0.08 | $0.08 | — |
| Image vers vidéo / Images de début et fin vers vidéo / Référence vers vidéo · 768p | $0.08 | — | — |
| Texte vers vidéo · 2k | $0.13 | $0.13 | — |
| Image vers vidéo / Images de début et fin vers vidéo / Référence vers vidéo · 2k | $0.13 | — | — |
| Référence vers vidéo · Entrée image · Les 5 premières images sont gratuites | $0.04/image | — | — |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez MiniMax H3 dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à créer avec hailuo-h3 via text-to-video sur /v1/videos/generations. Affiche le résultat, le statut et le coût.
Cas d'usage
Idéal pour- Multimodal
- Texte vers vidéo
Du storyboard au plan
Fournissez une première et une dernière image ainsi qu'un prompt décrivant le mouvement entre les deux pour obtenir un test de mouvement qui aboutit à une composition finale planifiée.
Clips avec cohérence des personnages
Fournissez des images de référence d'un personnage ou d'un produit et placez-les dans de nouvelles scènes à travers plusieurs clips.
Scènes avec gestion du son
Ajoutez un clip audio comme référence pour orienter le rythme ou l'ambiance du plan généré.
Plans principaux haute résolution
Rendez un plan clé en 2K pour une bannière de site web ou une épreuve de film.
Exemples de prompts
Commencer sur la porte fermée, finir sur la porte ouverte avec la lumière qui inonde la pièce ; lent travelling avant, couloir poussiéreux.
En utilisant la photo de référence de la basket rouge, montrez-la en rotation sur un socle en béton sous des éclairages de studio.
Un festival de lanternes en papier la nuit, la caméra s'élevant au-dessus de la foule, la lueur chaude se reflétant sur une rivière.
FAQ
En quoi MiniMax H3 est-il différent de Hailuo 2.3 ?
H3 est la nouvelle génération multimodale. Au-delà du texte et de l'entrée d'une image unique, il accepte des images de début et de fin ainsi que des images, vidéos et audios de référence, et atteint une résolution 2K. Hailuo 2.3 accepte un prompt et une seule image.
Puis-je définir à la fois la première et la dernière image ?
Oui. Fournissez une image de début et une image de fin, et le modèle animera la transition entre les deux. La documentation de MiniMax traite cela comme un mode distinct de la génération par référence.
Quelles références H3 peut-il utiliser ?
Jusqu'à neuf images, trois clips vidéo et trois clips audio, selon la documentation de MiniMax, avec un total plafonné à quinze secondes pour la vidéo et pour l'audio.
Quelles résolutions propose-t-il ?
768p et 2K selon la documentation de MiniMax. La variante H3-Max sacrifie la résolution maximale au profit de la vitesse et propose du 480p et du 768p au lieu des tailles supérieures.
Quelle est la durée des clips ?
Six ou dix secondes. Choisissez six secondes pour une action unique ou la présentation d'un produit, et dix secondes lorsque le plan nécessite un mouvement de caméra ou un changement au sein de la scène. Pour des séquences plus longues, générez plusieurs clips et assemblez-les dans un logiciel de montage.
Combien coûte MiniMax H3 ?
Sur TokenLab, MiniMax H3 coûte $0.08-$0.13 par seconde. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.
Quel endpoint MiniMax H3 doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/videos/generations pour MiniMax H3. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations MiniMax H3 prend-il en charge ?
MiniMax H3 prend en charge Image vers vidéo, Référence vers vidéo, Images de début et fin vers vidéo, Texte vers vidéo. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer MiniMax H3
Sources
Mis à jour le 2 oct. 2026