Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente. Veja as novidades

Perplexity: pplx-embed-v1-4b

O Perplexity Embed v1 4B mapeia textos e consultas independentes em vetores para recuperação semântica e RAG. Ele suporta uma janela de contexto de 32K e retorna vetores de 2560 dimensões por meio da API de Embeddings; seu baixo preço por token de entrada é adequado para grandes índices de documentos.
Comparar modelos
pplx-embed-v1-4b
DisponívelPerplexityIncorporaçãoSíncrono
Contexto
32K
Modalidades
Incorporação

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    IncorporaçãoEndpoint do TokenLab
    POST/v1/embeddings
    curl -X POST "https://api.tokenlab.sh/v1/embeddings" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "encoding_format": "float",
      "model": "pplx-embed-v1-4b",
      "input": "The quick brown fox jumps over the lazy dog."
    }'

Preço

O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.

Incorporação

Por 1M Token
Preço oficial
Entrada $0.03 / Saída $0.00
Preço da TokenLab
-
Desconto
-

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas

Ainda sem dados

Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Perplexity Embed v1 4B no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar pplx-embed-v1-4b com embedding em /v1/embeddings. Exiba o resultado e custo.

Casos de uso

01

Busca semântica

Construa representações vetoriais para busca, recomendação, clustering e RAG.

02

Comparação direta

Compare qualidade de resposta, latência e preço lado a lado.

Exemplos de prompt

Faça embedding de cinco trechos de FAQ de produto e explique o formato da resposta.

Envie a menor solicitação possível e mostre o resultado e o custo.

Compare este modelo com um mais barato da mesma categoria — quando vale cada um?

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Quanto custa o Perplexity Embed v1 4B?

No TokenLab, Perplexity Embed v1 4B custa — Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Como posso testar o Perplexity Embed v1 4B?

Abra Perplexity Embed v1 4B no Create para testar um exemplo preparado para /v1/embeddings.

Qual endpoint o Perplexity Embed v1 4B deve usar?

Use https://api.tokenlab.sh/v1/embeddings para Perplexity Embed v1 4B. O exemplo de requisição abaixo mostra o formato de código correspondente.

Posso testar o Perplexity Embed v1 4B antes de integrar?

Sim. Abrir o Console inicia um rascunho pronto para Perplexity Embed v1 4B e mantém seu prompt após o login, sem perder contexto.

Quais operações o Perplexity Embed v1 4B suporta?

Perplexity Embed v1 4B suporta Incorporação. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Mais da série Perplexity Embedding

Modelos relacionados