- 输入 / 输出
- $0.1029 / $0.00
- 上下文
- 120K
- 模态
- 视觉聊天
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
重排序TokenLab 端点POST/v1/rerankcurl -X POST "https://api.tokenlab.sh/v1/rerank" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "operation": "rerank", "model": "qwen3-vl-rerank", "query": "What is the capital of France?", "documents": [ "Paris is the capital of France.", "Berlin is the capital of Germany." ] }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
Default
每 1M token- 官方价格
- 输入 $0.1029 / 文本 输入 $0.1029 / 图像 输入 $0.2647
- TokenLab 价格
- 输入 $0.1029 / 文本 输入 $0.1029 / 图像 输入 $0.2647
- 折扣
- -
Display Base Rates
每 1M token- 官方价格
- 输出 $0.00
- TokenLab 价格
- 输出 $0.00
- 折扣
- -
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| Default | 输入 $0.1029 / 文本 输入 $0.1029 / 图像 输入 $0.2647 | 输入 $0.1029 / 文本 输入 $0.1029 / 图像 输入 $0.2647 | - |
| Display Base Rates | 输出 $0.00 | 输出 $0.00 | - |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时还没有数据
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Qwen-Rerank 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 qwen3-vl-rerank 完成一次 rerank,接口是 /v1/rerank。返回结果和费用。
使用场景
适用场景视觉
读取图片、解析文档、回答视觉问题
搜索质量
重排检索候选,提升搜索和 RAG 的头部结果精度。
并排对比
并列比较回复质量、延迟和价格。
提示词示例
针对查询“最适合商品图的图片生成模型”,重排这些搜索结果。
发一个最简请求,展示结果和费用。
把这个模型和同类别更便宜的模型对比:各自在什么情况下值得选?
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Qwen-Rerank 的费用是多少?
在 TokenLab 上,Qwen-Rerank 的价格为 输入 $0.1029 / 输出 $0.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Qwen-Rerank 适合做什么?
Qwen-Rerank 支持 视觉,可以直接在 Create 中打开。
如何测试 Qwen-Rerank?
在 Create 里打开 Qwen-Rerank,就能直接用为 /v1/rerank 准备的示例。
Qwen-Rerank 应该使用哪个端点?
Qwen-Rerank 使用 https://api.tokenlab.sh/v1/rerank。代码写法见下方的请求示例。
接入前可以先测试 Qwen-Rerank 吗?
可以。打开 Console 会为 Qwen-Rerank 备好一个现成的草稿,登录后提示词还在,上下文不会丢。
Qwen-Rerank 支持哪些操作?
Qwen-Rerank 支持 重排序。选了操作,上面会显示对应的端点和请求示例。