Stability: Stable Audio 3.0
stable-audio-3- Precio
- Desde $0.26
- Modalidades
- Audio
Sobre Stable Audio 3.0
Stable Audio 3.0 es la familia de modelos de generación de audio de Stability AI, que produce música y sonido a partir de descripciones escritas con salida de duración variable. Devuelve MP3 o WAV. Stability enumera Large para producción de sonido empresarial, Medium para canciones completas, y Small y Small SFX para generación en dispositivos móviles. Usted elige la duración para ajustarse a una banda sonora, una idea instrumental o un efecto.
Puntos fuertes
- La duración es variable, por lo que un clip puede coincidir con la longitud que necesite un proyecto.
- Cubre tanto música como efectos de sonido dentro de una misma familia.
- La salida puede entregarse como MP3 o WAV.
Cuándo buscar otra opción
- La salida es música instrumental y efectos de sonido a partir de una descripción; no está ajustada para letras cantadas o una voz específica.
- Para letras y canciones vocales, un servicio de música centrado en canciones es una opción más adecuada.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
MúsicaEndpoint de TokenLabPOST/v1/music/generationscurl -X POST "https://api.tokenlab.sh/v1/music/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "duration": 30, "output_format": "mp3", "model": "stable-audio-3", "prompt": "Warm ambient piano with subtle rain textures.", "title": "Evening Drift" }'
Precios
El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.
Precios
por solicitud- Official
- $0.26por solicitud
- Precio Official
- $0.26por solicitud
| Precio Officialpor solicitud | Officialpor solicitud | Descuento | |
|---|---|---|---|
| Precio | $0.26por solicitud | $0.26por solicitud | — |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Stable Audio 3.0 en Console con un prompt listo para editar o enviar.
Ayúdame a crear con stable-audio-3 usando music en /v1/music/generations. Muestra el resultado, el estado y el coste.
Casos de uso
Bases de banda sonora
Genere música de fondo de una duración elegida para colocar bajo un video, un menú de juego o una demostración de producto, luego recórtela o póngala en bucle en su editor.
Bocetos instrumentales
Pruebe ideas de género, tempo y estado de ánimo de forma rápida y económica antes de encargar a un compositor o elegir una pista con licencia para un proyecto.
Efectos de sonido
Cree impactos, ambiente y foley para escenas e interfaces a partir de una breve descripción escrita, eligiendo la longitud que coincida con la señal que necesita.
Audio de prototipo
Llene una demostración de aplicación o juego con sonido de marcador de posición para que los revisores puedan juzgar el ritmo y la sensación antes de que el audio final sea producido por un diseñador de sonido.
Ejemplos de prompts
Lo-fi hip hop tranquilo, piano suave y crujido de vinilo, 90 BPM, 45 segundos.
Construcción orquestal épica de tráiler con oleadas de metales y una parada en seco a los 30 segundos.
Lluvia sobre un techo de chapa con truenos distantes, 15 segundos.
FAQ
¿Qué es Stable Audio 3.0?
Es la familia de modelos de texto a audio de Stability AI para música y efectos de sonido. La salida tiene una duración variable, por lo que usted elige la duración, y la familia abarca desde modelos grandes orientados a estudio hasta modelos pequeños creados para dispositivos móviles.
¿Qué tamaños de Stable Audio 3 existen?
La página de Stability enumera Large para producción de sonido empresarial, Medium para composición de canciones completas con pesos abiertos, y Small y Small SFX para generación en dispositivos móviles. Los puntos de control Small también se ofrecen como modelos separados.
¿Qué formatos devuelve?
MP3 y WAV. MP3 ofrece un archivo compacto para vistas previas y uso web, mientras que WAV mantiene audio sin comprimir que se adapta a la edición en una estación de trabajo de audio digital o una línea de tiempo de video.
¿Puedo establecer la duración del audio?
Sí. La generación de duración variable es una característica declarada de la familia, por lo que usted especifica la duración que necesita en lugar de cortar un clip fijo posteriormente. Ajústelo a la señal, escena o bucle que esté creando.
¿Canta letras Stable Audio 3.0?
Stability describe la familia como generadora de música y efectos de sonido a partir de texto, no de canciones basadas en letras. Si necesita una voz cantada con palabras, elija un modelo de generación de canciones dedicado como Suno.
¿Cuánto cuesta Stable Audio 3.0?
En TokenLab, Stable Audio 3.0 cuesta $0.26 por solicitud. La tabla de precios arriba muestra el desglose completo.
¿Qué endpoint debe usar Stable Audio 3.0?
Utiliza https://api.tokenlab.sh/v1/music/generations para Stable Audio 3.0. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Stable Audio 3.0?
Stable Audio 3.0 admite Música. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Stable Audio 3.0
Fuentes
Revisado el 2 oct 2026