Alibaba: Sambert Zhiyuan v1
sambert-zhiyuan-v1- 입력 / 출력
- $14.71 / $0.00
- 모달리티
- 오디오
Sambert Zhiyuan v1 소개
Sambert Zhiyuan v1은 알리바바 Sambert 음성 합성 제품군에 속한 특정 음성 모델로, 일반적인 중국어 내레이션 용도로 제작되었습니다. Zhiyuan은 차분하고 학구적인 여성 음성으로 영어도 읽을 수 있으며, 단어 단위 타임스탬프와 기본 16kHz 샘플링 레이트를 지원합니다. CosyVoice v3.5 Plus나 Qwen3-TTS-Flash와 달리 음성 복제, 방언 목록, 스타일 제어 기능이 없는 구형 고정 음성 엔진입니다.
강점
- 일관된 음성을 제공하여 반복되는 콘텐츠에서도 동일한 내레이터처럼 들립니다.
- 타임스탬프를 지원하여 자막을 동기화하거나 텍스트가 읽힐 때 강조 표시를 하는 데 유용합니다.
- 중국어와 영어 텍스트를 읽습니다.
- 기사나 공지사항과 같이 차분하고 설명적인 콘텐츠에 적합합니다.
다른 모델이 필요한 경우
- 복제나 디자인이 불가능한 고정 음성이므로, 맞춤형 브랜드 음성을 표현할 수 없습니다.
- 감정이나 스타일을 제어하는 지시 기능이 없는 구형 Sambert 세대 모델입니다.
- 기본 16kHz 출력은 최신 합성 모델보다 음질이 낮습니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트 음성 변환TokenLab 엔드포인트POST/v1/audio/speechcurl -X POST "https://api.tokenlab.sh/v1/audio/speech" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "operation": "tts", "response_format": "mp3", "speed": 1, "model": "sambert-zhiyuan-v1", "input": "Hello from TokenLab.", "voice": "alloy" }'
가격 책정
Official 가격은 모델 제작사의 공식 기본 가격입니다. TokenLab 가격은 TokenLab에서 이 모델을 사용할 때 지불하는 금액입니다.
Tts Text Number
100만 문자당- Official 가격
- 입력 $14.71 / 출력 $0.00
- Official
- 입력 $14.71 / 출력 $0.00
- 할인
- —
| Official 가격100만 문자당 | Official100만 문자당 | 할인 | |
|---|---|---|---|
| Tts Text Number | 입력 $14.71 / 출력 $0.00 | 입력 $14.71 / 출력 $0.00 | — |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 Sambert Zhiyuan v1을 열고 프롬프트를 수정하거나 전송하세요.
/v1/audio/speech에서 sambert-zhiyuan-v1로 짧은 오디오 요청을 테스트합니다. 결과와 비용을 확인하세요.
사용 사례
기사 읽기
페이지가 넘어가도 일정한 음성으로 긴 중국어 기사를 읽어줍니다.
자막이 포함된 설명 영상
타임스탬프를 사용하여 짧은 교육 영상에서 화면 텍스트와 내레이션을 동기화합니다.
공지사항
키오스크, 앱 및 안내 방송 스타일의 메시지를 위해 일관된 톤으로 반복적인 공지사항을 생성합니다.
프롬프트 예제
이 공지사항을 차분하고 일정한 속도의 표준 중국어로 읽어주세요.
다음 단락을 내레이션하고, 자막용 단어 타임스탬프를 제공해주세요.
이 이중 언어 제품 소개를 읽어주세요. 중국어를 먼저 읽고 영어를 나중에 읽어주세요.
FAQ
Sambert Zhiyuan v1이란 무엇인가요?
알리바바 Sambert 텍스트-투-스피치 제품군의 Zhiyuan이라는 고정 여성 음성입니다. 알리바바는 이를 차분하고 학구적인 톤의 범용 중국어 음성으로 설명하며, 영어 텍스트도 처리할 수 있습니다.
타임스탬프를 지원하나요?
네. 알리바바는 이 음성에 대한 타임스탬프 출력을 제공하며, 이를 통해 오디오 재생 시 자막을 정렬하거나 단어를 강조할 수 있습니다. 이는 읽기 및 설명 앱에서 유용합니다.
음성을 사용자 지정할 수 있나요?
아니요. Zhiyuan은 고정된 음성입니다. 음성 복제, 디자인 또는 스타일 지시가 필요하면 CosyVoice v3.5 Plus를 사용하고, HTTP를 통한 즉시 사용 가능한 다국어 음성이 필요하면 Qwen3-TTS-Flash를 사용하세요.
어떤 샘플링 레이트로 출력되나요?
알리바바 문서에 따르면 기본값은 16kHz입니다. 이는 앱이나 프롬프트용 음성에는 적합하지만, 음악이나 방송용으로는 최신 합성 모델이 더 풍부한 오디오를 제공할 수 있습니다.
Sambert가 여전히 좋은 선택인 경우는 언제인가요?
방언, 복제, 감정 제어가 필요하지 않으면서 안정적이고 예측 가능한 중국어 내레이터와 타임스탬프가 필요할 때입니다. 대부분의 새로운 프로젝트에는 언어 지원 범위가 더 넓은 Qwen3-TTS-Flash를 권장합니다.
Sambert Zhiyuan v1 의 가격은 얼마인가요?
TokenLab 에서 Sambert Zhiyuan v1 은 입력 $14.71 / 출력 $0.00 100만 문자당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
Sambert Zhiyuan v1 은 어떤 엔드포인트를 써야 하나요?
Sambert Zhiyuan v1에 대해 https://api.tokenlab.sh/v1/audio/speech를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
Sambert Zhiyuan v1 은 어떤 오퍼레이션을 지원하나요?
Sambert Zhiyuan v1은(는) 텍스트 음성 변환을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
Sambert Zhiyuan v1 비교하기
출처
2026. 10. 2. 검토 완료