每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。 查看更新

Perplexity: pplx-embed-v1-0.6b

Perplexity Embed v1 0.6B 将独立文本和查询转换为语义检索与 RAG 使用的向量。它支持 32K 上下文,并通过 Embeddings API 返回 1024 维向量;较低的输入 token 价格适合大型文档索引。
对比模型
pplx-embed-v1-0.6b
可用Perplexity嵌入同步
上下文
32K
模态
嵌入

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    嵌入TokenLab 端点
    POST/v1/embeddings
    curl -X POST "https://api.tokenlab.sh/v1/embeddings" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "encoding_format": "float",
      "model": "pplx-embed-v1-0.6b",
      "input": "The quick brown fox jumps over the lazy dog."
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

嵌入

每 1M token
官方价格
输入 $0.004 / 输出 $0.00
TokenLab 价格
-
折扣
-

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时

还没有数据

模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Perplexity Embed v1 0.6B 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 pplx-embed-v1-0.6b 完成一次 embedding,接口是 /v1/embeddings。返回结果和费用。

使用场景

01

语义搜索

为搜索、推荐、聚类和 RAG 构建向量表示。

02

并排对比

并列比较回复质量、延迟和价格。

提示词示例

嵌入五条产品 FAQ 片段,再解释一下响应结构。

发一个最简请求,展示结果和费用。

把这个模型和同类别更便宜的模型对比:各自在什么情况下值得选?

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Perplexity Embed v1 0.6B 的费用是多少?

在 TokenLab 上,Perplexity Embed v1 0.6B 的价格为 — 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

如何测试 Perplexity Embed v1 0.6B?

在 Create 里打开 Perplexity Embed v1 0.6B,就能直接用为 /v1/embeddings 准备的示例。

Perplexity Embed v1 0.6B 应该使用哪个端点?

Perplexity Embed v1 0.6B 使用 https://api.tokenlab.sh/v1/embeddings。代码写法见下方的请求示例。

接入前可以先测试 Perplexity Embed v1 0.6B 吗?

可以。打开 Console 会为 Perplexity Embed v1 0.6B 备好一个现成的草稿,登录后提示词还在,上下文不会丢。

Perplexity Embed v1 0.6B 支持哪些操作?

Perplexity Embed v1 0.6B 支持 嵌入。选了操作,上面会显示对应的端点和请求示例。

更多 Perplexity Embedding 模型

相关模型