Stability: Stable Audio 3.0
stable-audio-3- Prix
- À partir de $0.26
- Modalités
- Audio
À propos de Stable Audio 3.0
Stable Audio 3.0 est la famille de modèles de génération audio de Stability AI, produisant de la musique et des sons à partir de descriptions écrites avec une sortie à durée variable. Il renvoie du MP3 ou du WAV. Stability propose Large pour la production sonore en entreprise, Medium pour des chansons complètes, et Small et Small SFX pour la génération sur appareil mobile. Vous choisissez la durée pour correspondre à une bande-son, une idée instrumentale ou un effet.
Points forts
- La durée est variable, ce qui permet à un clip de correspondre à la longueur nécessaire pour un projet.
- Couvre à la fois la musique et les effets sonores au sein d'une même famille.
- La sortie peut être fournie en MP3 ou en WAV.
Quand préférer un autre modèle
- La sortie est constituée de musique instrumentale et d'effets sonores à partir d'une description ; le modèle n'est pas réglé pour les paroles chantées ou une voix spécifique.
- Pour les paroles et les chansons vocales, un service musical axé sur les chansons est plus approprié.
Pour commencer
Créer une clé API
Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.
Envoyez votre première requête
Copiez l'exemple pour votre langage et lancez-le.
MusiqueEndpoint TokenLabPOST/v1/music/generationscurl -X POST "https://api.tokenlab.sh/v1/music/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "duration": 30, "output_format": "mp3", "model": "stable-audio-3", "prompt": "Warm ambient piano with subtle rain textures.", "title": "Evening Drift" }'
Tarification
Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.
Tarification
par requête- Official
- $0.26par requête
- Tarif Official
- $0.26par requête
| Tarif Officialpar requête | Officialpar requête | Remise | |
|---|---|---|---|
| Prix | $0.26par requête | $0.26par requête | — |
Utilisation et activité
Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.
Utilisation et disponibilité
Dernières 24 heures- Requêtes
- Taux de succès
- Latence P95
- Total des jetons
Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.
Ouvrir dans Console
Ouvrez Stable Audio 3.0 dans Console avec un prompt prêt à modifier ou envoyer.
Aide-moi à créer avec stable-audio-3 via music sur /v1/music/generations. Affiche le résultat, le statut et le coût.
Cas d'usage
Bandes-son d'ambiance
Générez une musique de fond d'une durée choisie pour accompagner une vidéo, un menu de jeu ou une démonstration de produit, puis coupez-la ou mettez-la en boucle dans votre éditeur.
Esquisses instrumentales
Testez rapidement et à moindre coût des idées de genre, de tempo et d'ambiance avant de commander un compositeur ou de choisir un morceau sous licence pour un projet.
Effets sonores
Créez des impacts, des ambiances et des bruitages pour des scènes et des interfaces à partir d'une courte description écrite, en choisissant la longueur qui correspond au repère dont vous avez besoin.
Audio de prototypage
Remplissez une démo d'application ou de jeu avec un son temporaire afin que les évaluateurs puissent juger le rythme et la sensation avant que l'audio final ne soit produit par un concepteur sonore.
Exemples de prompts
Lo-fi hip hop calme, piano doux et craquements de vinyle, 90 BPM, 45 secondes.
Montée orchestrale épique pour bande-annonce avec des cuivres et un arrêt brutal à 30 secondes.
Pluie sur un toit en tôle avec tonnerre au loin, 15 secondes.
FAQ
Qu'est-ce que Stable Audio 3.0 ?
Il s'agit de la famille de modèles de conversion de texte en audio de Stability AI pour la musique et les effets sonores. La sortie a une durée variable, vous choisissez donc la durée, et la famille s'étend des grands modèles orientés studio aux petits modèles conçus pour les appareils mobiles.
Quelles tailles de Stable Audio 3 existent ?
La page de Stability répertorie Large pour la production sonore en entreprise, Medium pour la composition de chansons complètes avec poids ouverts, et Small et Small SFX pour la génération sur appareil mobile. Les points de contrôle Small sont également proposés en tant que modèles distincts.
Quels formats renvoie-t-il ?
MP3 et WAV. Le MP3 fournit un fichier compact pour les aperçus et l'utilisation sur le web, tandis que le WAV conserve l'audio non compressé, ce qui convient au montage dans une station de travail audio numérique ou sur une timeline vidéo.
Puis-je définir la durée de l'audio ?
Oui. La génération à durée variable est une fonctionnalité déclarée de la famille ; vous spécifiez donc la durée dont vous avez besoin au lieu de couper un clip fixe par la suite. Adaptez-la au repère, à la scène ou à la boucle que vous créez.
Stable Audio 3.0 chante-t-il des paroles ?
Stability décrit la famille comme générant de la musique et des effets sonores à partir de texte, et non des chansons basées sur des paroles. Si vous avez besoin d'une voix chantée avec des mots, choisissez un modèle de génération de chansons dédié tel que Suno.
Combien coûte Stable Audio 3.0 ?
Sur TokenLab, Stable Audio 3.0 coûte $0.26 par requête. La table tarifaire ci-dessus en montre le détail complet.
Quel endpoint Stable Audio 3.0 doit-il utiliser ?
Utilisez https://api.tokenlab.sh/v1/music/generations pour Stable Audio 3.0. L'exemple de requête ci-dessous montre la structure de code correspondante.
Quelles opérations Stable Audio 3.0 prend-il en charge ?
Stable Audio 3.0 prend en charge Musique. Sélectionnez une opération pour voir l'endpoint et un exemple.
Comparer Stable Audio 3.0
Sources
Mis à jour le 2 oct. 2026