每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Alibaba: Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15 是固定日期的语音识别版本,用于音频文件转写,适合需要在多次处理时保持模型版本选择一致的流程。
对比模型
fun-asr-flash-2026-06-15
可用Alibaba语音转文本同步
价格
起 $0.000035
模态
音频

Fun-ASR Flash 2026-06-15 简介

Fun-ASR Flash 2026-06-15 是阿里巴巴 Flash 语音识别模型的一个带日期版本,阿里对外的名称是 Qwen-Audio-3.0-ASR-Flash。它通过同步 HTTP 调用转写短音频文件,并可把之前的对话轮次作为上下文,来引导识别。固定使用带日期的 ID,可以让流程停留在同一个版本上,不像不带日期的别名那样可能被更新。

擅长的任务

  • 音频之外还可传入之前的对话轮次,当前讨论中的词汇会引导识别结果。
  • 阿里列出,同一个同步响应里就带有逐词时间戳和句子边界。
  • ID 中的日期固定了一个发布版本,多次运行的结果才有可比性。

什么情况换别的模型

  • 音频片段上限约 5 分钟,长录音需要用异步的 Fun-ASR 或 filetrans 模型。
  • 它只处理录制完成的片段;需要实时字幕或听写,用流式模型 Fun-ASR Realtime。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    语音转文字TokenLab 端点
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="fun-asr-flash-2026-06-15" \
      -F language="en"

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

语音转文字

每秒
官方价格
$0.000035
Official
$0.000035
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Fun-ASR Flash 2026-06-15 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 fun-asr-flash-2026-06-15 发起一条简短的音频请求,接口是 /v1/audio/transcriptions。返回结果和费用。

使用场景

  • 语音备忘

    一次请求就转写短录音备忘和消息,不用排队等异步任务。

  • 医疗听写

    把前面的对话作为上下文传入,药品名和临床术语更容易被识别出来。

  • 固定版本的测试流程

    保持版本不变,在相同转写稿上对比下游摘要环节的变化。

提示词示例

转写这段 3 分钟的门诊录音;上下文:上一轮讨论的是二甲双胍的剂量。

转写这段现场工程师关于 PLC 故障的语音备忘,并返回逐词时间戳。

转写这段客户通话的短片段,把前面的聊天内容作为上下文。

FAQ

fun-asr-flash-2026-06-15 里的日期是什么意思?

它标识一个具体的发布版本,即 2026 年 6 月 15 日。调用带日期的 ID,流程就固定在这个版本上。阿里对外使用的名称是 Qwen-Audio-3.0-ASR-Flash。

音频片段最长可以多长?

阿里文档给出的限制是每次调用约 5 分钟,文件最大 2 GB。更长的录音请用 Fun-ASR 或 Qwen3 ASR Flash Filetrans,两者都接受异步文件任务。

可以把对话背景传给它吗?

可以。它使用聊天式的消息格式,可以在音频前传入之前的对话轮次。模型会据此偏向与主题相关的词汇,对专业术语有帮助。

会返回时间戳吗?

会。阿里说明响应里带逐词时间戳和句子边界,做字幕、审校或检索时,不需要单独的对齐步骤,就能把文本与音频对应起来。

Fun-ASR Flash 2026-06-15 的费用是多少?

在 TokenLab 上,Fun-ASR Flash 2026-06-15 的价格为 $0.000035 每秒。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Fun-ASR Flash 2026-06-15 应该使用哪个端点?

Fun-ASR Flash 2026-06-15 使用 https://api.tokenlab.sh/v1/audio/transcriptions。代码写法见下方的请求示例。

Fun-ASR Flash 2026-06-15 支持哪些操作?

Fun-ASR Flash 2026-06-15 支持 语音转文字。选了操作,上面会显示对应的端点和请求示例。

Fun-ASR Flash 2026-06-15 对比

资料来源

审阅于 2026年10月2日

更多 Fun-ASR 模型

相关模型