Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Alibaba: CosyVoice v3.5 Plus

CosyVoice v3.5 Plus chuyển đổi kịch bản viết thành giọng nói biểu cảm. Sử dụng cho các bài viết tường thuật, lồng tiếng hội thoại và hướng dẫn sản phẩm bằng lời nói, với giọng đọc và tốc độ nói được lựa chọn phù hợp với khán giả.
So sánh mô hình
cosyvoice-v3.5-plus
Sẵn sàngAlibabaVăn bản thành giọng nóiĐồng bộ
Đầu vào / Đầu ra
$22.06 / $0.00
Phương thức
Âm thanh

Về CosyVoice v3.5 Plus

CosyVoice v3.5 Plus là mô hình tổng hợp giọng nói của Alibaba dành cho các giọng nói do chính bạn tạo ra. Nó không có danh sách giọng nói có sẵn: bạn sao chép (clone) một giọng nói từ mẫu hoặc thiết kế một giọng nói từ mô tả văn bản, sau đó tổng hợp bằng giọng nói đó qua kết nối WebSocket. Nó nói tiếng Quan Thoại, tiếng Anh và một số ngôn ngữ khác, cộng với nhiều phương ngữ Trung Quốc, và nó nhận các hướng dẫn bằng ngôn ngữ tự nhiên để điều khiển cách truyền đạt, điều mà Qwen3-TTS-Flash không làm được.

Ưu điểm

  • Hoạt động với các giọng nói được sao chép từ bản ghi âm hoặc giọng nói được thiết kế từ mô tả bằng văn bản.
  • Chấp nhận các hướng dẫn để kiểm soát tông giọng và phong cách nói.
  • Nói tiếng Quan Thoại, tiếng Quảng Đông và nhiều phương ngữ Trung Quốc cũng như tiếng Anh, tiếng Pháp, tiếng Đức, tiếng Nhật, tiếng Hàn, tiếng Nga, tiếng Bồ Đào Nha, tiếng Thái, tiếng Indonesia và tiếng Việt.
  • Truyền phát âm thanh qua WebSocket, vì vậy quá trình phát lại có thể bắt đầu trước khi quá trình tổng hợp kết thúc.

Khi nào nên chọn model khác

  • Nó không có giọng nói hệ thống tích hợp sẵn; bạn phải tạo một giọng nói được sao chép hoặc thiết kế trước.
  • Nó yêu cầu một máy khách WebSocket thay vì một yêu cầu HTTP đơn giản.
  • Việc sao chép giọng nói cần một mẫu tham chiếu sạch và sự đồng ý sử dụng giọng nói đó.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản thành giọng nóiĐiểm cuối TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "cosyvoice-v3.5-plus",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Cosy Tts Number

Mỗi 1 triệu ký tự
Giá niêm yết
Đầu vào $22.06 / Đầu ra $0.00
Official
Đầu vào $22.06 / Đầu ra $0.00
Giảm giá
—

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở CosyVoice v3.5 Plus trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử cosyvoice-v3.5-plus với yêu cầu âm thanh ngắn tại /v1/audio/speech. Hiển thị kết quả và chi phí.

Tình huống sử dụng

  • Giọng nói thương hiệu

    Sao chép một người nói đã được phê duyệt một lần và sử dụng giọng nói đó cho các chuyến tham quan sản phẩm, lời nhắc IVR và thông báo.

  • Giọng nói nhân vật

    Thiết kế một giọng nói từ mô tả, chẳng hạn như một người kể chuyện lớn tuổi ấm áp, cho sách nói hoặc trò chơi.

  • Lời dẫn bằng phương ngữ địa phương

    Tạo nội dung nói bằng tiếng Tứ Xuyên, Thượng Hải hoặc tiếng Quảng Đông cho khán giả địa phương.

Ví dụ prompt

Đọc thông báo này với tông giọng nhanh nhẹn, vui vẻ, với một khoảng dừng ngắn sau ngày tháng.

Nói đoạn văn sau một cách chậm rãi và ấm áp, như thể đang đọc một câu chuyện trước khi đi ngủ.

Nói điều này bằng tiếng Quảng Đông với nhịp điệu thoải mái, đàm thoại.

FAQ

CosyVoice v3.5 Plus có giọng nói cài sẵn không?

Không. Alibaba không liệt kê giọng nói hệ thống nào cho mô hình này. Bạn cần một giọng nói được sao chép từ mẫu hoặc giọng nói được thiết kế từ mô tả văn bản, sau đó truyền giọng nói đó khi tổng hợp.

Nó hỗ trợ những ngôn ngữ và phương ngữ nào?

Tiếng Quan Thoại, tiếng Quảng Đông và nhiều phương ngữ Trung Quốc, cộng với tiếng Anh, tiếng Pháp, tiếng Đức, tiếng Nhật, tiếng Hàn, tiếng Nga, tiếng Bồ Đào Nha, tiếng Thái, tiếng Indonesia và tiếng Việt. Hỗ trợ phương ngữ là điểm khác biệt chính so với các mô hình Qwen3-TTS-Flash.

Tôi có thể kiểm soát âm thanh của nó không?

Có. Mô hình hỗ trợ kiểm soát bằng hướng dẫn, vì vậy bạn có thể mô tả tông giọng, cảm xúc hoặc nhịp độ bằng ngôn ngữ tự nhiên. Việc chọn giọng nói xác định ai là người nói; hướng dẫn định hình cách câu thoại được truyền đạt.

Nó được gọi như thế nào?

Thông qua API WebSocket truyền phát âm thanh ngược lại khi nó được tạo. Điều này phù hợp với các kịch bản dài và phát lại trực tiếp, nhưng bạn sẽ cần một máy khách xử lý kết nối.

Khi nào tôi nên chọn Qwen3-TTS-Flash thay thế?

Khi bạn muốn các giọng nói có sẵn và một lệnh gọi HTTP đơn giản và không cần sao chép hoặc hướng dẫn. Hãy chọn CosyVoice khi danh tính giọng nói hoặc phong cách truyền đạt là một phần trong sản phẩm của bạn.

CosyVoice v3.5 Plus có giá bao nhiêu?

Trên TokenLab, CosyVoice v3.5 Plus có giá Đầu vào $22.06 / Đầu ra $0.00 Mỗi 1 triệu ký tự. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

CosyVoice v3.5 Plus nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/audio/speech làm mặc định cho CosyVoice v3.5 Plus. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

CosyVoice v3.5 Plus hỗ trợ những thao tác nào?

CosyVoice v3.5 Plus hỗ trợ Văn bản thành giọng nói. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh CosyVoice v3.5 Plus

Nguồn

Đánh giá ngày 2 thg 10, 2026

Mô hình liên quan