Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Stability: Stable Audio 3.0

O Stable Audio 3 gera música e som a partir de descrições escritas. Sua geração de áudio de duração variável é útil para combinar uma trilha sonora, uma ideia instrumental ou um efeito sonoro com a duração necessária para um projeto.
Comparar modelos
stable-audio-3
DisponívelStabilityMúsicaAssíncrono
Preço
A partir de $0.26
Modalidades
Áudio

Sobre o Stable Audio 3.0

O Stable Audio 3.0 é a família de modelos de geração de áudio da Stability AI, produzindo música e som a partir de descrições escritas com saída de duração variável. Ele retorna MP3 ou WAV. A Stability lista o Large para produção de som empresarial, o Medium para músicas completas, e o Small e Small SFX para geração em dispositivos móveis. Você escolhe a duração para se ajustar a uma trilha sonora, uma ideia instrumental ou um efeito.

Pontos fortes

  • A duração é variável, para que um clipe possa corresponder ao comprimento que um projeto precisa.
  • Cobre tanto música quanto efeitos sonoros dentro de uma mesma família.
  • A saída pode ser entregue em MP3 ou WAV.

Quando usar outro modelo

  • A saída consiste em música instrumental e efeitos sonoros a partir de uma descrição; não é ajustada para letras cantadas ou uma voz específica.
  • Para letras e músicas vocais, um serviço de música focado em canções é uma opção melhor.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    MúsicaEndpoint do TokenLab
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "duration": 30,
      "output_format": "mp3",
      "model": "stable-audio-3",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

Preço

O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.

Preço

por requisição
Official
$0.26por requisição
Preço oficial
$0.26por requisição

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Stable Audio 3.0 no Console com um prompt pronto para editar ou enviar.

Ajude-me a criar com stable-audio-3 usando music em /v1/music/generations. Exiba o resultado, status e custo.

Casos de uso

  • Bases de trilha sonora

    Gere música de fundo com uma duração escolhida para ficar sob um vídeo, um menu de jogo ou uma demonstração de produto, depois corte ou coloque em loop no seu editor.

  • Esboços instrumentais

    Experimente ideias de gênero, tempo e humor de forma rápida e barata antes de contratar um compositor ou escolher uma faixa licenciada para um projeto.

  • Efeitos sonoros

    Crie impactos, ambiência e foley para cenas e interfaces a partir de uma breve descrição escrita, escolhendo a duração que corresponde ao cue de que você precisa.

  • Áudio de protótipo

    Preencha uma demonstração de aplicativo ou jogo com som temporário para que os revisores possam julgar o ritmo e a sensação antes que o áudio final seja produzido por um designer de som.

Exemplos de prompt

Lo-fi hip hop calmo, piano suave e chiado de vinil, 90 BPM, 45 segundos.

Construção orquestral épica de trailer com crescendos de metais e uma parada brusca aos 30 segundos.

Chuva em um telhado de zinco com trovões distantes, 15 segundos.

FAQ

O que é o Stable Audio 3.0?

É a família de modelos de texto para áudio da Stability AI para música e efeitos sonoros. A saída tem duração variável, então você escolhe o tempo, e a família abrange desde modelos grandes voltados para estúdio até modelos pequenos criados para dispositivos móveis.

Quais tamanhos do Stable Audio 3 existem?

A página da Stability lista o Large para produção de som empresarial, o Medium para composição de músicas completas com pesos abertos, e o Small e Small SFX para geração em dispositivos móveis. Os checkpoints Small também são oferecidos como modelos separados.

Quais formatos ele retorna?

MP3 e WAV. O MP3 oferece um arquivo compacto para pré-visualizações e uso na web, enquanto o WAV mantém áudio não compactado que é adequado para edição em uma estação de trabalho de áudio digital ou linha do tempo de vídeo.

Posso definir a duração do áudio?

Sim. A geração de duração variável é um recurso declarado da família, portanto, você especifica a duração de que precisa em vez de cortar um clipe fixo posteriormente. Combine-o com o cue, cena ou loop que você está criando.

O Stable Audio 3.0 canta letras?

A Stability descreve a família como geradora de música e efeitos sonoros a partir de texto, não de músicas com letras. Se você precisa de um vocal cantado com palavras, escolha um modelo dedicado de geração de músicas, como o Suno.

Quanto custa o Stable Audio 3.0?

No TokenLab, Stable Audio 3.0 custa $0.26 por requisição. A tabela de preços acima mostra o detalhamento completo.

Qual endpoint o Stable Audio 3.0 deve usar?

Use https://api.tokenlab.sh/v1/music/generations para Stable Audio 3.0. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Stable Audio 3.0 suporta?

Stable Audio 3.0 suporta Música. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Stable Audio 3.0

Fontes

Revisado em 2 de out. de 2026

Mais da série Stable Audio

Modelos relacionados