Alibaba: Paraformer v2
paraformer-v2- 價格
- 起 $0.000012
- 模態
- 音訊
關於 Paraformer v2
Paraformer v2 是阿里巴巴的檔案式語音辨識模型,用於會議與長對話的離線轉錄。它以非同步方式處理長達 2 GB 與 12 小時的錄音檔。相較於 Paraformer 8K v2,此模型專為一般寬頻音訊設計;與即時模型相比,它犧牲了即時性,以換取包含說話者分離(diarization)與熱詞(hotwords)的完整轉錄內容。
適用場景
- 根據阿里巴巴的文件,可處理非常長的錄音,每個檔案上限為 12 小時或 2 GB。
- 時間戳記(timestamps)為預設包含,無需額外選項即可取得。
- 說話者分離功能可區分會議與小組討論中的不同參與者。
- 敏感詞過濾功能可遮蔽轉錄文字中列出的特定詞彙。
其他選擇建議
- 結果會在任務完成後送達;若需即時字幕,請使用 Paraformer Realtime v2。
- 針對 8 kHz 的電話錄音,8K 版本能更精準地匹配音訊。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
語音轉文字TokenLab 端點POST/v1/audio/transcriptionscurl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \ -H "Authorization: Bearer sk-xxx" \ -F file="@audio.mp3" \ -F operation="stt" \ -F response_format="json" \ -F model="paraformer-v2" \ -F language="en"
定價
Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。
語音轉文字
每秒- Official 定價
- $0.00001176
- Official
- $0.00001176
- 折扣
- —
| Official 定價每秒 | Official每秒 | 折扣 | |
|---|---|---|---|
| 語音轉文字 | $0.00001176 | $0.00001176 | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Paraformer v2,並準備好編輯或發送提示詞。
協助我使用 paraformer-v2 透過 /v1/audio/transcriptions 進行音訊請求,並顯示結果與成本。
應用情境
會議存檔
將儲存的會議錄音處理為可搜尋的文字,並附帶說話者標籤與時間戳記。
講座轉錄
一次轉錄長達數小時的講座,隨後為學生建立文字索引或摘要。
內容審核準備
在將轉錄內容分享給更廣泛的團隊前,先遮蔽設定好的敏感詞。
提示詞範例
轉錄這段 3 小時的全體會議錄音,並附上說話者標籤與時間戳記。
轉錄這段講座影片的音訊,並遮蔽列出的敏感詞。
使用熱詞功能轉錄這些每週站立會議的錄音,以識別我們的專案名稱。
FAQ
Paraformer v2 最適合用於什麼場景?
錄製會議、訪談與對話的離線轉錄。它接受各種主流音訊與影片格式,不限採樣率,並回傳包含時間戳記的文字。
輸入檔案大小限制為何?
阿里巴巴的文件指出其 Paraformer 檔案模型支援上限為 2 GB 與 12 小時的檔案。若超過此限制,請在提交轉錄前將檔案分割。
可以關閉時間戳記嗎?
不行。阿里巴巴表示 Paraformer 的時間戳記功能是永久啟用的,因此每份轉錄內容都會包含時間戳記,無需額外請求選項即可取得時間位置。
該選 Paraformer v2 還是 Fun-ASR?
兩者皆能進行包含說話者分離與熱詞功能的檔案轉錄。Fun-ASR 是較新的系列,而 Paraformer v2 則是較成熟的產品。建議您使用兩者分別測試一段音訊,並比較對您而言較重要的誤差表現。
Paraformer v2 的費用是多少?
在 TokenLab 上,Paraformer v2 價格為 $0.00001176 每秒。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Paraformer v2 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/audio/transcriptions 進行 Paraformer v2 的呼叫。下方的請求範例展示了對應的程式碼格式。
Paraformer v2 支援哪些操作?
Paraformer v2 支援 語音轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Paraformer v2
來源
- Model Studio: recording file recognition models
- Model Studio: speech-to-text models for real-time and file transcription
更新於 2026年10月2日