TokenLab

Texte

Réorganiser les documents

Réorganise les documents par pertinence par rapport à une requête

POST
/v1/rerank

Réorganisez les documents à l'aide de modèles de similitude sémantique. Utile pour améliorer les résultats de recherche et les applications RAG.

Corps de la requête

Pour les entrées volumineuses, réglez le délai du client HTTP sur au moins 120s. La réponse arrive à la fin du traitement.

modelstringrequis

ID du modèle de reranker à utiliser (par ex., qwen3-vl-rerank).

querystringrequis

La requête par rapport à laquelle classer les documents. Longueur maximale : 32,000 caractères.

documentsarrayrequis

Liste de documents (chaînes de caractères) à réorganiser. Limites : jusqu'à 1,000 documents, chaque document jusqu'à 100,000 caractères, et au plus 2,000,000 caractères de documents au total.

top_ninteger

Nombre de meilleurs résultats, de 1 à documents.length. Si omis, le modèle sélectionné détermine ce nombre.

return_documentsbooleanpar défaut: false

Indique s'il faut inclure le texte original du document dans la réponse.

Réponse

resultsarray

Liste classée des documents avec scores.

Chaque résultat contient :

  • index (integer) : Index du document original
  • relevance_score (number): Score de pertinence. Sa plage dépend du modèle sélectionné.
  • document (string) : Texte original (si return_documents=true)
modelstring

Le modèle utilisé pour la réorganisation. Renvoyé si disponible.

usageobject

Statistiques d'utilisation des tokens. Renvoyé si disponible.

Requête

curl -X POST "https://api.tokenlab.sh/v1/rerank" \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-vl-rerank",
    "query": "What is machine learning?",
    "documents": [
      "Machine learning is a subset of AI",
      "The weather is nice today",
      "Deep learning uses neural networks"
    ],
    "top_n": 2,
    "return_documents": true
  }'

Réponse

Response
{
  "results": [
    {
      "index": 0,
      "relevance_score": 0.95,
      "document": "Machine learning is a subset of AI"
    },
    {
      "index": 2,
      "relevance_score": 0.82,
      "document": "Deep learning uses neural networks"
    }
  ],
  "model": "qwen3-vl-rerank",
  "usage": {
    "prompt_tokens": 45,
    "total_tokens": 45
  }
}

Autorisation

BearerAuth
AuthorizationBearer <token>

Authentification par clé API. Créez ou gérez vos clés API dans Dashboard > API > API Keys.

Emplacement: header

En-têtes

X-TokenLab-Delivery-Policy?string

Politique de livraison par requête. Remplace les valeurs par défaut de la clé API et de l'espace de travail. Tente automatiquement TokenLab Verified en premier et peut basculer une fois vers Official uniquement avant la sortie, l'acceptation de la requête ou la création de ressource persistante.

Valeurs possibles

  • "auto"
  • "verified"
  • "official"

Corps de la requête

application/json

Réponse

application/json

application/json

application/json

application/json