Alibaba: Fun-ASR Flash 2026-06-15
fun-asr-flash-2026-06-15- 价格
- 起 $0.000035
- 模态
- 音频
Fun-ASR Flash 2026-06-15 简介
Fun-ASR Flash 2026-06-15 是阿里巴巴 Flash 语音识别模型的一个带日期版本,阿里对外的名称是 Qwen-Audio-3.0-ASR-Flash。它通过同步 HTTP 调用转写短音频文件,并可把之前的对话轮次作为上下文,来引导识别。固定使用带日期的 ID,可以让流程停留在同一个版本上,不像不带日期的别名那样可能被更新。
擅长的任务
- 音频之外还可传入之前的对话轮次,当前讨论中的词汇会引导识别结果。
- 阿里列出,同一个同步响应里就带有逐词时间戳和句子边界。
- ID 中的日期固定了一个发布版本,多次运行的结果才有可比性。
什么情况换别的模型
- 音频片段上限约 5 分钟,长录音需要用异步的 Fun-ASR 或 filetrans 模型。
- 它只处理录制完成的片段;需要实时字幕或听写,用流式模型 Fun-ASR Realtime。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
语音转文字TokenLab 端点POST/v1/audio/transcriptionscurl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \ -H "Authorization: Bearer sk-xxx" \ -F file="@audio.mp3" \ -F operation="stt" \ -F response_format="json" \ -F model="fun-asr-flash-2026-06-15" \ -F language="en"
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
语音转文字
每秒- 官方价格
- $0.000035
- Official
- $0.000035
- 折扣
- —
| 官方价格每秒 | Official每秒 | 折扣 | |
|---|---|---|---|
| 语音转文字 | $0.000035 | $0.000035 | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Fun-ASR Flash 2026-06-15 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 fun-asr-flash-2026-06-15 发起一条简短的音频请求,接口是 /v1/audio/transcriptions。返回结果和费用。
使用场景
语音备忘
一次请求就转写短录音备忘和消息,不用排队等异步任务。
医疗听写
把前面的对话作为上下文传入,药品名和临床术语更容易被识别出来。
固定版本的测试流程
保持版本不变,在相同转写稿上对比下游摘要环节的变化。
提示词示例
转写这段 3 分钟的门诊录音;上下文:上一轮讨论的是二甲双胍的剂量。
转写这段现场工程师关于 PLC 故障的语音备忘,并返回逐词时间戳。
转写这段客户通话的短片段,把前面的聊天内容作为上下文。
FAQ
fun-asr-flash-2026-06-15 里的日期是什么意思?
它标识一个具体的发布版本,即 2026 年 6 月 15 日。调用带日期的 ID,流程就固定在这个版本上。阿里对外使用的名称是 Qwen-Audio-3.0-ASR-Flash。
音频片段最长可以多长?
阿里文档给出的限制是每次调用约 5 分钟,文件最大 2 GB。更长的录音请用 Fun-ASR 或 Qwen3 ASR Flash Filetrans,两者都接受异步文件任务。
可以把对话背景传给它吗?
可以。它使用聊天式的消息格式,可以在音频前传入之前的对话轮次。模型会据此偏向与主题相关的词汇,对专业术语有帮助。
会返回时间戳吗?
会。阿里说明响应里带逐词时间戳和句子边界,做字幕、审校或检索时,不需要单独的对齐步骤,就能把文本与音频对应起来。
Fun-ASR Flash 2026-06-15 的费用是多少?
在 TokenLab 上,Fun-ASR Flash 2026-06-15 的价格为 $0.000035 每秒。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Fun-ASR Flash 2026-06-15 应该使用哪个端点?
Fun-ASR Flash 2026-06-15 使用 https://api.tokenlab.sh/v1/audio/transcriptions。代码写法见下方的请求示例。
Fun-ASR Flash 2026-06-15 支持哪些操作?
Fun-ASR Flash 2026-06-15 支持 语音转文字。选了操作,上面会显示对应的端点和请求示例。
Fun-ASR Flash 2026-06-15 对比
资料来源
- Model Studio: speech-to-text models for real-time and file transcription
- Model Studio: recording file recognition models
审阅于 2026年10月2日