為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。 查看最新動態

Cohere: rerank-v4.0-fast

Cohere Rerank 4 Fast 根據查詢的相關性對檢索到的文件進行排序,並著重於延遲與吞吐量。它支援多語言文字檢索,並按報告的搜尋單元計費,適用於 RAG 管道中檢索與答案生成之間的環節。
比較模型
rerank-v4.0-fast
可用Cohere重排序 (Rerank)同步
模態
對話

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    重新排序TokenLab 端點
    POST/v1/rerank
    curl -X POST "https://api.tokenlab.sh/v1/rerank" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "rerank",
      "model": "rerank-v4.0-fast",
      "query": "What is the capital of France?",
      "documents": [
        "Paris is the capital of France.",
        "Berlin is the capital of Germany."
      ]
    }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

重新排序

按請求計費
Official 定價
$0.002
TokenLab 價格
-
折扣
-

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時

暫無資料

模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Cohere Rerank 4 Fast,並準備好編輯或發送提示詞。

協助我使用 rerank-v4.0-fast 透過 /v1/rerank 執行 rerank,並顯示結果與成本。

應用情境

01

搜尋品質

對召回候選做重排,提升搜尋與 RAG 的頭部結果精確度。

02

同台對比

並排比較回應品質、延遲與價格。

提示詞範例

對查詢「最適合商品圖的圖片生成模型」重排這些搜尋結果。

發送最小請求,並顯示結果與成本。

和同類裡更便宜的模型對比一下,各自什麼時候該選?

FAQ

Cohere Rerank 4 Fast 的費用是多少?

在 TokenLab 上,Cohere Rerank 4 Fast 價格為 — 按請求計費。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

我該如何測試 Cohere Rerank 4 Fast?

在 Create 中開啟 Cohere Rerank 4 Fast,即可使用為 /v1/rerank 準備的範例。

Cohere Rerank 4 Fast 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/rerank 進行 Cohere Rerank 4 Fast 的呼叫。下方的請求範例展示了對應的程式碼格式。

接入前可以先測試 Cohere Rerank 4 Fast 嗎?

可以。開啟 Console 會為 Cohere Rerank 4 Fast 建立一個預先填好的草稿,登入後提示詞不會遺失,可以直接接著測試。

Cohere Rerank 4 Fast 支援哪些操作?

Cohere Rerank 4 Fast 支援 重新排序。請在上方選擇一項操作以查看其端點與請求範例。

更多來自 Cohere Rerank 的模型

相關模型