오디오 모델

음성, 음악 및 오디오 처리를 위한 AI 모델

17 모델5개 제공사데이터 기준일: 2026. 9. 16.

오디오 · xAI

grok-voice-latest
사용 가능
TokenLab 가격/ Official 가격
$0.001333/초
grok-voice-stt
사용 가능
음성 인식(STT)
TokenLab 가격/ Official 가격
$0.00002778/초
grok-voice-think-fast-2.0
사용 가능
TokenLab 가격/ Official 가격
$0.001333/초
grok-voice-tts
사용 가능
텍스트 음성 변환
TokenLab 가격/ Official 가격
입력$15.00
출력$0.00
/자

모든 모델 시리즈

1 시리즈

최적의 오디오 모델 선택하기

작업 적합성, 결과 품질, 응답 속도, 비용을 고려해 최적의 모델을 선택하세요.

선택 신호

  • 실제 필요한 입력과 출력에 맞는 모델을 선택하세요.
  • 동일한 가격 단위를 사용하는 모델끼리 비교하세요.
  • 간단한 테스트로 카탈로그에는 없는 품질과 지연 시간 차이를 확인하세요.

FAQ

좋은 오디오 모델의 기준은 무엇인가요?

작업 목적, 품질 기준, 응답 속도, 예산에 딱 맞는 모델이 좋은 모델입니다. 작은 평가 세트를 활용하면 품질과 안정성 차이를 쉽게 파악할 수 있습니다.

나중에 모델을 변경할 수 있나요?

네. 공개 모델 ID와 요청 형식을 명확히 유지하고 동일한 작업에서 대안 모델들을 비교해 보세요.