Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Stability: Stable Audio 3.0

Stable Audio 3 tạo nhạc và âm thanh từ các mô tả bằng văn bản. Khả năng tạo âm thanh với độ dài thay đổi của mô hình này hữu ích cho việc khớp nhạc nền, ý tưởng nhạc cụ hoặc hiệu ứng âm thanh với thời lượng cần thiết của một dự án.
So sánh mô hình
stable-audio-3
Sẵn sàngStabilityÂm nhạcBất đồng bộ
Giá
Từ $0.26
Phương thức
Âm thanh

Về Stable Audio 3.0

Stable Audio 3.0 là dòng mô hình tạo âm thanh của Stability AI, tạo ra âm nhạc và âm thanh từ các mô tả bằng văn bản với đầu ra có độ dài tùy biến. Nó trả về định dạng MP3 hoặc WAV. Stability liệt kê phiên bản Large cho sản xuất âm thanh doanh nghiệp, Medium cho các bài hát hoàn chỉnh, và Small cùng Small SFX để tạo trên thiết bị di động. Bạn chọn thời lượng để phù hợp với nhạc nền, ý tưởng nhạc cụ hoặc hiệu ứng.

Ưu điểm

  • Thời lượng có thể thay đổi, vì vậy một đoạn clip có thể khớp với độ dài mà dự án yêu cầu.
  • Bao gồm cả âm nhạc và hiệu ứng âm thanh trong cùng một dòng sản phẩm.
  • Đầu ra có thể được cung cấp dưới dạng MP3 hoặc WAV.

Khi nào nên chọn model khác

  • Đầu ra là nhạc cụ và hiệu ứng âm thanh từ mô tả; nó không được tinh chỉnh cho lời hát hoặc giọng hát cụ thể.
  • Đối với lời bài hát và các bài hát có giọng hát, một dịch vụ âm nhạc tập trung vào bài hát sẽ phù hợp hơn.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Âm nhạcĐiểm cuối TokenLab
    POST/v1/music/generations
    curl -X POST "https://api.tokenlab.sh/v1/music/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "duration": 30,
      "output_format": "mp3",
      "model": "stable-audio-3",
      "prompt": "Warm ambient piano with subtle rain textures.",
      "title": "Evening Drift"
    }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Giá

mỗi yêu cầu
Official
$0.26mỗi yêu cầu
Giá niêm yết
$0.26mỗi yêu cầu

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Stable Audio 3.0 trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi tạo với stable-audio-3 sử dụng music tại /v1/music/generations. Hiển thị kết quả, trạng thái và chi phí.

Tình huống sử dụng

  • Nhạc nền

    Tạo nhạc nền với độ dài đã chọn để lồng vào video, menu trò chơi hoặc bản demo sản phẩm, sau đó cắt hoặc lặp lại trong trình chỉnh sửa của bạn.

  • Bản phác thảo nhạc cụ

    Thử nghiệm các ý tưởng về thể loại, nhịp độ và tâm trạng một cách nhanh chóng và tiết kiệm chi phí trước khi đặt hàng một nhà soạn nhạc hoặc chọn một bản nhạc có bản quyền cho dự án.

  • Hiệu ứng âm thanh

    Tạo các âm thanh va chạm, âm thanh nền và foley cho các cảnh quay và giao diện từ một mô tả ngắn bằng văn bản, chọn độ dài khớp với đoạn âm thanh bạn cần.

  • Âm thanh mẫu (Prototype)

    Lấp đầy bản demo ứng dụng hoặc trò chơi bằng âm thanh tạm thời để người đánh giá có thể nhận xét về nhịp độ và cảm giác trước khi âm thanh cuối cùng được nhà thiết kế âm thanh sản xuất.

Ví dụ prompt

Lo-fi hip hop nhẹ nhàng, piano êm dịu và tiếng đĩa than lách tách, 90 BPM, 45 giây.

Nhạc trailer dàn nhạc hùng tráng với tiếng kèn đồng dâng trào và dừng đột ngột ở giây thứ 30.

Tiếng mưa trên mái tôn với tiếng sấm xa xa, 15 giây.

FAQ

Stable Audio 3.0 là gì?

Đây là dòng mô hình chuyển văn bản thành âm thanh của Stability AI dành cho âm nhạc và hiệu ứng âm thanh. Đầu ra có độ dài tùy biến, vì vậy bạn chọn thời lượng, và dòng sản phẩm này bao gồm nhiều kích cỡ từ các mô hình lớn hướng đến phòng thu cho đến các mô hình nhỏ được xây dựng cho thiết bị di động.

Stable Audio 3 có những kích cỡ nào?

Trang của Stability liệt kê phiên bản Large cho sản xuất âm thanh doanh nghiệp, Medium cho sáng tác bài hát hoàn chỉnh với trọng số mở, và Small cùng Small SFX để tạo trên thiết bị di động. Các checkpoint Small cũng được cung cấp dưới dạng các mô hình riêng biệt.

Nó trả về những định dạng nào?

MP3 và WAV. MP3 cung cấp tệp nhỏ gọn để xem trước và sử dụng trên web, trong khi WAV giữ lại âm thanh không nén phù hợp để chỉnh sửa trong trạm làm việc âm thanh kỹ thuật số (DAW) hoặc dòng thời gian video.

Tôi có thể đặt độ dài của âm thanh không?

Có. Tạo âm thanh với độ dài tùy biến là một tính năng đã được công bố của dòng sản phẩm này, vì vậy bạn chỉ định thời lượng mình cần thay vì phải cắt một đoạn clip cố định sau đó. Hãy khớp nó với đoạn âm thanh, cảnh quay hoặc vòng lặp mà bạn đang xây dựng.

Stable Audio 3.0 có hát lời không?

Stability mô tả dòng sản phẩm này tạo ra âm nhạc và hiệu ứng âm thanh từ văn bản, không phải các bài hát có lời. Nếu bạn cần giọng hát có lời, hãy chọn một mô hình tạo bài hát chuyên dụng như Suno.

Stable Audio 3.0 có giá bao nhiêu?

Trên TokenLab, Stable Audio 3.0 có giá $0.26 mỗi yêu cầu. Bảng giá phía trên cho thấy chi tiết đầy đủ.

Stable Audio 3.0 nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/music/generations làm mặc định cho Stable Audio 3.0. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Stable Audio 3.0 hỗ trợ những thao tác nào?

Stable Audio 3.0 hỗ trợ Âm nhạc. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Stable Audio 3.0

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ Stable Audio

Mô hình liên quan