Stability: Stable Audio 3.0
stable-audio-3- Preço
- A partir de $0.26
- Modalidades
- Áudio
Sobre o Stable Audio 3.0
O Stable Audio 3.0 é a família de modelos de geração de áudio da Stability AI, produzindo música e som a partir de descrições escritas com saída de duração variável. Ele retorna MP3 ou WAV. A Stability lista o Large para produção de som empresarial, o Medium para músicas completas, e o Small e Small SFX para geração em dispositivos móveis. Você escolhe a duração para se ajustar a uma trilha sonora, uma ideia instrumental ou um efeito.
Pontos fortes
- A duração é variável, para que um clipe possa corresponder ao comprimento que um projeto precisa.
- Cobre tanto música quanto efeitos sonoros dentro de uma mesma família.
- A saída pode ser entregue em MP3 ou WAV.
Quando usar outro modelo
- A saída consiste em música instrumental e efeitos sonoros a partir de uma descrição; não é ajustada para letras cantadas ou uma voz específica.
- Para letras e músicas vocais, um serviço de música focado em canções é uma opção melhor.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
MúsicaEndpoint do TokenLabPOST/v1/music/generationscurl -X POST "https://api.tokenlab.sh/v1/music/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "duration": 30, "output_format": "mp3", "model": "stable-audio-3", "prompt": "Warm ambient piano with subtle rain textures.", "title": "Evening Drift" }'
Preço
O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.
Preço
por requisição- Official
- $0.26por requisição
- Preço oficial
- $0.26por requisição
| Preço oficialpor requisição | Officialpor requisição | Desconto | |
|---|---|---|---|
| Preço | $0.26por requisição | $0.26por requisição | — |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra Stable Audio 3.0 no Console com um prompt pronto para editar ou enviar.
Ajude-me a criar com stable-audio-3 usando music em /v1/music/generations. Exiba o resultado, status e custo.
Casos de uso
Bases de trilha sonora
Gere música de fundo com uma duração escolhida para ficar sob um vídeo, um menu de jogo ou uma demonstração de produto, depois corte ou coloque em loop no seu editor.
Esboços instrumentais
Experimente ideias de gênero, tempo e humor de forma rápida e barata antes de contratar um compositor ou escolher uma faixa licenciada para um projeto.
Efeitos sonoros
Crie impactos, ambiência e foley para cenas e interfaces a partir de uma breve descrição escrita, escolhendo a duração que corresponde ao cue de que você precisa.
Áudio de protótipo
Preencha uma demonstração de aplicativo ou jogo com som temporário para que os revisores possam julgar o ritmo e a sensação antes que o áudio final seja produzido por um designer de som.
Exemplos de prompt
Lo-fi hip hop calmo, piano suave e chiado de vinil, 90 BPM, 45 segundos.
Construção orquestral épica de trailer com crescendos de metais e uma parada brusca aos 30 segundos.
Chuva em um telhado de zinco com trovões distantes, 15 segundos.
FAQ
O que é o Stable Audio 3.0?
É a família de modelos de texto para áudio da Stability AI para música e efeitos sonoros. A saída tem duração variável, então você escolhe o tempo, e a família abrange desde modelos grandes voltados para estúdio até modelos pequenos criados para dispositivos móveis.
Quais tamanhos do Stable Audio 3 existem?
A página da Stability lista o Large para produção de som empresarial, o Medium para composição de músicas completas com pesos abertos, e o Small e Small SFX para geração em dispositivos móveis. Os checkpoints Small também são oferecidos como modelos separados.
Quais formatos ele retorna?
MP3 e WAV. O MP3 oferece um arquivo compacto para pré-visualizações e uso na web, enquanto o WAV mantém áudio não compactado que é adequado para edição em uma estação de trabalho de áudio digital ou linha do tempo de vídeo.
Posso definir a duração do áudio?
Sim. A geração de duração variável é um recurso declarado da família, portanto, você especifica a duração de que precisa em vez de cortar um clipe fixo posteriormente. Combine-o com o cue, cena ou loop que você está criando.
O Stable Audio 3.0 canta letras?
A Stability descreve a família como geradora de música e efeitos sonoros a partir de texto, não de músicas com letras. Se você precisa de um vocal cantado com palavras, escolha um modelo dedicado de geração de músicas, como o Suno.
Quanto custa o Stable Audio 3.0?
No TokenLab, Stable Audio 3.0 custa $0.26 por requisição. A tabela de preços acima mostra o detalhamento completo.
Qual endpoint o Stable Audio 3.0 deve usar?
Use https://api.tokenlab.sh/v1/music/generations para Stable Audio 3.0. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o Stable Audio 3.0 suporta?
Stable Audio 3.0 suporta Música. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar Stable Audio 3.0
Fontes
Revisado em 2 de out. de 2026