각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

Alibaba: Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15는 오디오 파일 전사를 위한 날짜 지정 음성 인식 릴리스입니다. 이 버전을 고정하는 것은 전사 파이프라인이 반복적인 처리 과정 전반에 걸쳐 일관된 모델 선택을 유지해야 할 때 유용합니다.
모델 비교
fun-asr-flash-2026-06-15
사용 가능Alibaba음성 인식(STT)동기
가격
부터 $0.000035
모달리티
오디오

Fun-ASR Flash 2026-06-15 소개

Fun-ASR Flash 2026-06-15는 알리바바의 Flash 음성 인식 모델의 특정 날짜 버전으로, 알리바바는 이를 Qwen-Audio-3.0-ASR-Flash라는 명칭으로 제공합니다. 이 모델은 동기식 HTTP 호출을 통해 짧은 오디오 파일을 전사하며, 이전 대화 내용을 문맥으로 활용하여 인식 정확도를 높입니다. 날짜가 포함된 ID를 고정하면 업데이트될 수 있는 일반 별칭과 달리 파이프라인을 특정 버전으로 유지할 수 있습니다.

강점

  • 오디오와 함께 이전 대화 내용을 입력받아, 진행 중인 대화의 어휘를 바탕으로 인식을 유도합니다.
  • 알리바바는 동일한 동기식 응답 내에 단어 단위 타임스탬프와 문장 경계 정보를 포함합니다.
  • ID에 포함된 날짜는 특정 릴리스를 고정하므로 반복적인 실행 결과의 비교가 가능합니다.

다른 모델이 필요한 경우

  • 클립 길이는 약 5분으로 제한되므로, 긴 녹음 파일은 비동기식 Fun-ASR 또는 filetrans 모델을 사용해야 합니다.
  • 완료된 클립만 처리할 수 있습니다. 실시간 자막이나 받아쓰기에는 스트리밍 모델인 Fun-ASR Realtime을 사용하십시오.

시작하기

  1. API 키 만들기

    Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.

  2. 첫 번째 요청 보내기

    사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.

    음성-텍스트 변환TokenLab 엔드포인트
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="fun-asr-flash-2026-06-15" \
      -F language="en"

가격 책정

Official 가격은 모델 제작사의 공식 기본 가격입니다. TokenLab 가격은 TokenLab에서 이 모델을 사용할 때 지불하는 금액입니다.

음성-텍스트 변환

초당
Official 가격
$0.000035
Official
$0.000035
할인
—

사용량 및 활동

성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.

사용량 및 가용성

지난 24시간
요청
성공률
P95 지연 시간
총 토큰
모델 성능
개인정보 보호 및 데이터 볼륨 임계값이 충족되면 메트릭이 표시됩니다.

데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.

Console에서 열기

Console에서 Fun-ASR Flash 2026-06-15을 열고 프롬프트를 수정하거나 전송하세요.

/v1/audio/transcriptions에서 fun-asr-flash-2026-06-15로 짧은 오디오 요청을 테스트합니다. 결과와 비용을 확인하세요.

사용 사례

  • 음성 메모

    비동기 작업을 대기할 필요 없이 짧은 녹음 메모나 메시지를 한 번의 요청으로 전사합니다.

  • 의료용 받아쓰기

    이전 대화 내용을 문맥으로 전달하여 약물 이름이나 임상 용어의 인식률을 높입니다.

  • 고정된 테스트 파이프라인

    동일한 전사본을 기준으로 후속 요약 변경 사항을 비교할 때 버전을 일정하게 유지합니다.

프롬프트 예제

이 3분짜리 진료 녹음을 전사하십시오. 문맥: 이전 대화에서 메트포르민 복용량에 대해 논의함.

PLC 결함에 관한 현장 엔지니어의 음성 메모를 전사하고 단어별 타임스탬프를 반환하십시오.

이 짧은 고객 통화 클립을 이전 대화 내용을 문맥으로 활용하여 전사하십시오.

FAQ

fun-asr-flash-2026-06-15의 날짜는 무엇을 의미하나요?

이는 2026년 6월 15일이라는 특정 릴리스를 식별합니다. 날짜가 포함된 ID를 호출하면 해당 릴리스로 파이프라인이 유지됩니다. 알리바바는 이를 Qwen-Audio-3.0-ASR-Flash라는 이름으로 제공합니다.

오디오 클립의 길이는 어느 정도까지 가능한가요?

알리바바 문서에 따르면 호출당 약 5분, 최대 2GB 파일까지 제한됩니다. 더 긴 녹음은 비동기식 파일 작업을 지원하는 Fun-ASR 또는 Qwen3 ASR Flash Filetrans를 사용하십시오.

대화에 대한 문맥 정보를 제공할 수 있나요?

네. 대화형 메시지 형식을 사용하므로 오디오 이전에 이전 대화 내용을 전달할 수 있습니다. 모델은 이를 사용하여 주제에 적합한 어휘를 우선적으로 인식하며, 이는 전문 용어 처리에 도움이 됩니다.

타임스탬프를 반환하나요?

네. 알리바바는 응답에 단어 단위 타임스탬프와 문장 경계 정보를 포함하므로, 별도의 정렬 단계 없이 자막, 검토 또는 검색을 위해 텍스트를 오디오와 동기화할 수 있습니다.

Fun-ASR Flash 2026-06-15 의 가격은 얼마인가요?

TokenLab 에서 Fun-ASR Flash 2026-06-15 은 $0.000035 초당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

Fun-ASR Flash 2026-06-15 은 어떤 엔드포인트를 써야 하나요?

Fun-ASR Flash 2026-06-15에 대해 https://api.tokenlab.sh/v1/audio/transcriptions를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.

Fun-ASR Flash 2026-06-15 은 어떤 오퍼레이션을 지원하나요?

Fun-ASR Flash 2026-06-15은(는) 음성-텍스트 변환을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.

Fun-ASR Flash 2026-06-15 비교하기

출처

2026. 10. 2. 검토 완료

Fun-ASR의 다른 모델

관련 모델