Stability: Stable Audio 3.0
stable-audio-3- 가격
- 부터 $0.26
- 모달리티
- 오디오
Stable Audio 3.0 소개
Stable Audio 3.0은 Stability AI의 오디오 생성 모델 제품군으로, 글로 된 설명을 바탕으로 가변 길이의 음악과 사운드를 생성합니다. MP3 또는 WAV 형식으로 출력됩니다. Stability는 기업용 사운드 제작을 위한 Large, 전체 곡을 위한 Medium, 모바일 기기 생성을 위한 Small 및 Small SFX 모델을 제공합니다. 사운드트랙, 악기 아이디어, 효과음에 맞춰 길이를 선택할 수 있습니다.
강점
- 길이가 가변적이므로 프로젝트에 필요한 길이에 맞춰 클립을 생성할 수 있습니다.
- 하나의 제품군 내에서 음악과 효과음을 모두 다룹니다.
- MP3 또는 WAV 형식으로 출력할 수 있습니다.
다른 모델이 필요한 경우
- 설명을 바탕으로 기악곡과 효과음을 출력하며, 가사가 있는 노래나 특정 목소리에 최적화되어 있지 않습니다.
- 가사가 포함된 보컬 곡의 경우, 노래 중심의 음악 서비스를 이용하는 것이 더 적합합니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
음악TokenLab 엔드포인트POST/v1/music/generationscurl -X POST "https://api.tokenlab.sh/v1/music/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "duration": 30, "output_format": "mp3", "model": "stable-audio-3", "prompt": "Warm ambient piano with subtle rain textures.", "title": "Evening Drift" }'
가격 책정
Official 가격은 모델 제작사의 공식 기본 가격입니다. TokenLab 가격은 TokenLab에서 이 모델을 사용할 때 지불하는 금액입니다.
가격 책정
요청당- Official
- $0.26요청당
- Official 가격
- $0.26요청당
| Official 가격요청당 | Official요청당 | 할인 | |
|---|---|---|---|
| 가격 | $0.26요청당 | $0.26요청당 | — |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 Stable Audio 3.0을 열고 프롬프트를 수정하거나 전송하세요.
/v1/music/generations에서 music을(를) 사용하여 stable-audio-3로 생성합니다. 결과, 상태, 비용을 확인하세요.
사용 사례
사운드트랙 베드
영상, 게임 메뉴, 제품 데모의 배경으로 사용할 배경 음악을 원하는 길이로 생성한 뒤, 편집기에서 자르거나 루프하여 사용할 수 있습니다.
악기 스케치
작곡가에게 의뢰하거나 프로젝트용 라이선스 트랙을 선택하기 전에 장르, 템포, 분위기에 대한 아이디어를 저렴하고 빠르게 시도해 볼 수 있습니다.
효과음
짧은 설명을 바탕으로 장면과 인터페이스를 위한 충격음, 앰비언스, 폴리 사운드를 만들고 필요한 큐에 맞는 길이를 선택할 수 있습니다.
프로토타입 오디오
사운드 디자이너가 최종 오디오를 제작하기 전, 리뷰어가 페이싱과 느낌을 판단할 수 있도록 앱이나 게임 데모에 임시 사운드를 채울 수 있습니다.
프롬프트 예제
차분한 로파이 힙합, 부드러운 피아노와 바이닐 잡음, 90 BPM, 45초.
브라스가 고조되는 웅장한 오케스트라 트레일러 빌드업, 30초 지점에서 급정지.
멀리서 천둥소리가 들리는 양철 지붕 위의 빗소리, 15초.
FAQ
Stable Audio 3.0이란 무엇인가요?
음악 및 효과음을 위한 Stability AI의 텍스트-오디오 모델 제품군입니다. 출력 길이를 가변적으로 설정할 수 있어 원하는 길이를 선택할 수 있으며, 대규모 스튜디오용 모델부터 모바일 기기용 소형 모델까지 다양한 크기로 구성되어 있습니다.
Stable Audio 3에는 어떤 크기가 있나요?
Stability 페이지에는 기업용 사운드 제작을 위한 Large, 오픈 웨이트를 지원하는 전체 곡 작곡용 Medium, 모바일 기기 생성을 위한 Small 및 Small SFX가 나열되어 있습니다. Small 체크포인트는 별도의 모델로도 제공됩니다.
어떤 형식을 지원하나요?
MP3와 WAV를 지원합니다. MP3는 미리보기나 웹용으로 적합한 압축 파일이며, WAV는 디지털 오디오 워크스테이션이나 영상 타임라인에서 편집하기 좋은 비압축 오디오를 유지합니다.
오디오 길이를 설정할 수 있나요?
네. 가변 길이 생성은 이 제품군의 주요 기능으로, 사후에 클립을 자를 필요 없이 필요한 길이를 직접 지정할 수 있습니다. 제작 중인 큐, 장면 또는 루프에 맞춰 길이를 설정하십시오.
Stable Audio 3.0으로 가사가 있는 노래를 만들 수 있나요?
Stability는 이 제품군이 텍스트를 바탕으로 음악과 효과음을 생성하는 모델이며, 가사 중심의 노래를 위한 것이 아니라고 설명합니다. 가사가 포함된 보컬 곡이 필요하다면 Suno와 같은 전용 노래 생성 모델을 선택하십시오.
Stable Audio 3.0 의 가격은 얼마인가요?
TokenLab 에서 Stable Audio 3.0 은 $0.26 요청당 입니다. 자세한 내역은 위 가격 표를 확인하세요.
Stable Audio 3.0 은 어떤 엔드포인트를 써야 하나요?
Stable Audio 3.0에 대해 https://api.tokenlab.sh/v1/music/generations를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
Stable Audio 3.0 은 어떤 오퍼레이션을 지원하나요?
Stable Audio 3.0은(는) 음악을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
Stable Audio 3.0 비교하기
출처
2026. 10. 2. 검토 완료