Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado. Ver las novedades

Perplexity: pplx-embed-v1-4b

Perplexity Embed v1 4B asigna texto independiente y consultas a vectores para la recuperación semántica y RAG. Admite una ventana de contexto de 32K y devuelve vectores de 2560 dimensiones a través de la API de Embeddings; su bajo precio por token de entrada es adecuado para índices de documentos grandes.
Comparar modelos
pplx-embed-v1-4b
DisponiblePerplexityIncrustaciónSíncrono
Contexto
32K
Modalidades
Incrustación

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    IncrustaciónEndpoint de TokenLab
    POST/v1/embeddings
    curl -X POST "https://api.tokenlab.sh/v1/embeddings" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "encoding_format": "float",
      "model": "pplx-embed-v1-4b",
      "input": "The quick brown fox jumps over the lazy dog."
    }'

Precios

El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.

Incrustación

Por 1M Token
Precio Official
Entrada $0.03 / Salida $0.00
Precio de TokenLab
-
Descuento
-

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas

Aún no hay datos

Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Perplexity Embed v1 4B en Console con un prompt listo para editar o enviar.

Ayúdame a probar pplx-embed-v1-4b con embedding en /v1/embeddings. Muestra el resultado y el coste.

Casos de uso

01

Búsqueda semántica

Construye representaciones vectoriales para búsqueda, recomendaciones, clustering y RAG.

02

Comparación directa

Compara calidad, latencia y precio en una misma vista.

Ejemplos de prompts

Embebe cinco fragmentos de FAQ de producto y explica la forma de la respuesta.

Envía la solicitud más pequeña posible y muestra el resultado y el coste.

Compara este modelo con uno más barato de la misma categoría: ¿cuándo conviene cada uno?

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Cuánto cuesta Perplexity Embed v1 4B?

En TokenLab, Perplexity Embed v1 4B cuesta — Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cómo pruebo Perplexity Embed v1 4B?

Abre Perplexity Embed v1 4B en Create para probar un ejemplo preparado para /v1/embeddings.

¿Qué endpoint debe usar Perplexity Embed v1 4B?

Utiliza https://api.tokenlab.sh/v1/embeddings para Perplexity Embed v1 4B. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Puedo probar Perplexity Embed v1 4B antes de integrarlo?

Sí. Abrir Console inicia un borrador listo para Perplexity Embed v1 4B y conserva tu prompt tras iniciar sesión, sin perder contexto.

¿Qué operaciones soporta Perplexity Embed v1 4B?

Perplexity Embed v1 4B admite Incrustación. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Más de Perplexity Embedding

Modelos relacionados