각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

Alibaba: Sambert Zhiyuan v1

Sambert Zhiyuan v1은 중국어 음성 합성용 음성 모델입니다. 설명, 공지 사항 및 읽기 경험 전반에 걸쳐 일관된 성우 정체성을 공유해야 하는 만다린 내레이션에 유용합니다.
모델 비교
sambert-zhiyuan-v1
사용 가능Alibaba텍스트 음성 변환동기
입력 / 출력
$14.71 / $0.00
모달리티
오디오

Sambert Zhiyuan v1 소개

Sambert Zhiyuan v1은 알리바바 Sambert 음성 합성 제품군에 속한 특정 음성 모델로, 일반적인 중국어 내레이션 용도로 제작되었습니다. Zhiyuan은 차분하고 학구적인 여성 음성으로 영어도 읽을 수 있으며, 단어 단위 타임스탬프와 기본 16kHz 샘플링 레이트를 지원합니다. CosyVoice v3.5 Plus나 Qwen3-TTS-Flash와 달리 음성 복제, 방언 목록, 스타일 제어 기능이 없는 구형 고정 음성 엔진입니다.

강점

  • 일관된 음성을 제공하여 반복되는 콘텐츠에서도 동일한 내레이터처럼 들립니다.
  • 타임스탬프를 지원하여 자막을 동기화하거나 텍스트가 읽힐 때 강조 표시를 하는 데 유용합니다.
  • 중국어와 영어 텍스트를 읽습니다.
  • 기사나 공지사항과 같이 차분하고 설명적인 콘텐츠에 적합합니다.

다른 모델이 필요한 경우

  • 복제나 디자인이 불가능한 고정 음성이므로, 맞춤형 브랜드 음성을 표현할 수 없습니다.
  • 감정이나 스타일을 제어하는 지시 기능이 없는 구형 Sambert 세대 모델입니다.
  • 기본 16kHz 출력은 최신 합성 모델보다 음질이 낮습니다.

시작하기

  1. API 키 만들기

    Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.

  2. 첫 번째 요청 보내기

    사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.

    텍스트 음성 변환TokenLab 엔드포인트
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "sambert-zhiyuan-v1",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

가격 책정

Official 가격은 모델 제작사의 공식 기본 가격입니다. TokenLab 가격은 TokenLab에서 이 모델을 사용할 때 지불하는 금액입니다.

Tts Text Number

100만 문자당
Official 가격
입력 $14.71 / 출력 $0.00
Official
입력 $14.71 / 출력 $0.00
할인
—

사용량 및 활동

성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.

사용량 및 가용성

지난 24시간
요청
성공률
P95 지연 시간
총 토큰
모델 성능
개인정보 보호 및 데이터 볼륨 임계값이 충족되면 메트릭이 표시됩니다.

데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.

Console에서 열기

Console에서 Sambert Zhiyuan v1을 열고 프롬프트를 수정하거나 전송하세요.

/v1/audio/speech에서 sambert-zhiyuan-v1로 짧은 오디오 요청을 테스트합니다. 결과와 비용을 확인하세요.

사용 사례

  • 기사 읽기

    페이지가 넘어가도 일정한 음성으로 긴 중국어 기사를 읽어줍니다.

  • 자막이 포함된 설명 영상

    타임스탬프를 사용하여 짧은 교육 영상에서 화면 텍스트와 내레이션을 동기화합니다.

  • 공지사항

    키오스크, 앱 및 안내 방송 스타일의 메시지를 위해 일관된 톤으로 반복적인 공지사항을 생성합니다.

프롬프트 예제

이 공지사항을 차분하고 일정한 속도의 표준 중국어로 읽어주세요.

다음 단락을 내레이션하고, 자막용 단어 타임스탬프를 제공해주세요.

이 이중 언어 제품 소개를 읽어주세요. 중국어를 먼저 읽고 영어를 나중에 읽어주세요.

FAQ

Sambert Zhiyuan v1이란 무엇인가요?

알리바바 Sambert 텍스트-투-스피치 제품군의 Zhiyuan이라는 고정 여성 음성입니다. 알리바바는 이를 차분하고 학구적인 톤의 범용 중국어 음성으로 설명하며, 영어 텍스트도 처리할 수 있습니다.

타임스탬프를 지원하나요?

네. 알리바바는 이 음성에 대한 타임스탬프 출력을 제공하며, 이를 통해 오디오 재생 시 자막을 정렬하거나 단어를 강조할 수 있습니다. 이는 읽기 및 설명 앱에서 유용합니다.

음성을 사용자 지정할 수 있나요?

아니요. Zhiyuan은 고정된 음성입니다. 음성 복제, 디자인 또는 스타일 지시가 필요하면 CosyVoice v3.5 Plus를 사용하고, HTTP를 통한 즉시 사용 가능한 다국어 음성이 필요하면 Qwen3-TTS-Flash를 사용하세요.

어떤 샘플링 레이트로 출력되나요?

알리바바 문서에 따르면 기본값은 16kHz입니다. 이는 앱이나 프롬프트용 음성에는 적합하지만, 음악이나 방송용으로는 최신 합성 모델이 더 풍부한 오디오를 제공할 수 있습니다.

Sambert가 여전히 좋은 선택인 경우는 언제인가요?

방언, 복제, 감정 제어가 필요하지 않으면서 안정적이고 예측 가능한 중국어 내레이터와 타임스탬프가 필요할 때입니다. 대부분의 새로운 프로젝트에는 언어 지원 범위가 더 넓은 Qwen3-TTS-Flash를 권장합니다.

Sambert Zhiyuan v1 의 가격은 얼마인가요?

TokenLab 에서 Sambert Zhiyuan v1 은 입력 $14.71 / 출력 $0.00 100만 문자당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

Sambert Zhiyuan v1 은 어떤 엔드포인트를 써야 하나요?

Sambert Zhiyuan v1에 대해 https://api.tokenlab.sh/v1/audio/speech를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.

Sambert Zhiyuan v1 은 어떤 오퍼레이션을 지원하나요?

Sambert Zhiyuan v1은(는) 텍스트 음성 변환을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.

Sambert Zhiyuan v1 비교하기

출처

2026. 10. 2. 검토 완료

관련 모델