音频模型
处理语音、音乐和音频的 AI 模型
音频
全部模型系列
6 个系列Kling
图像视频+2
Auto 按不同模型采用不同计价单位
15 个模型打开系列
MiniMax
聊天图像+4
Auto 按不同模型采用不同计价单位
11 个模型打开系列
Grok Voice
音频文本转语音+1
Auto 按不同模型采用不同计价单位
6 个模型打开系列
Qwen Omni
聊天音频+3
Auto 低至 $0.15 · 每 1M token
4 个模型打开系列
Stable Audio
音频音乐
Auto 低至 $0.0206 · 每次请求
4 个模型打开系列
Qwen TTS
音频文本转语音+1
Auto 低至 $10.00 · 每百万字符
3 个模型打开系列