Zhipu AI: glm-5v-turbo
glm-5v-turbo- Entrada / Salida
- $1.20 / $4.00
- Contexto
- 205K
- Salida máxima
- 128K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de prompts
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
chat_completionCompatible con OpenAIPOST/v1/chat/completionscurl https://api.tokenlab.sh/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "glm-5v-turbo", "messages": [ {"role": "user", "content": "Hello!"} ] }'
Precios
El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.
Display Base Rates
Por 1M Token- Precio Official
- Entrada $1.20 / Salida $4.00 / Lectura de caché $0.24
- Precio de TokenLab
- Entrada $1.20 / Salida $4.00 / Lectura de caché $0.24
- Descuento
- -
Lectura de caché
- Precio Official
- $0.24
- Precio de TokenLab
- $0.24
- Descuento
- -
| Precio OfficialPor 1M Token | Precio de TokenLabPor 1M Token | Descuento | |
|---|---|---|---|
| Display Base Rates | Entrada $1.20 / Salida $4.00 / Lectura de caché $0.24 | Entrada $1.20 / Salida $4.00 / Lectura de caché $0.24 | - |
| Lectura de caché | $0.24 | $0.24 | - |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horasAún no hay datos
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre glm-5v-turbo en Console con un prompt listo para editar o enviar.
Ayúdame a probar glm-5v-turbo con un mensaje breve en /v1/chat/completions. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal paraVisión
Leer imágenes, parsear documentos y responder preguntas visuales
Agentes y herramientas
Gestiona razonamiento, triaje de soporte, llamadas a herramientas y tareas complejas.
Programación
Genera, revisa o depura código directamente en tus herramientas habituales.
Asistentes de conocimiento
Crea funciones de chat, búsqueda y recuperación con precios y capacidades transparentes.
Comparación directa
Compara calidad, latencia y precio en una misma vista.
Ejemplos de prompts
Escribe una respuesta de soporte concisa y enumera los supuestos detrás.
Revisa este diseño de API y señala los tres principales riesgos de integración.
Convierte un changelog largo en notas de versión que entienda alguien no técnico.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Cuánto cuesta glm-5v-turbo?
En TokenLab, glm-5v-turbo cuesta Entrada $1.20 / Salida $4.00 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Para qué es mejor glm-5v-turbo?
glm-5v-turbo admite Modo JSON, Caché de prompts, Uso de herramientas. Puedes abrirlo directamente en Create.
¿Cómo pruebo glm-5v-turbo?
Abre glm-5v-turbo en Create para probar un ejemplo preparado para /v1/chat/completions.
¿Qué endpoint debe usar glm-5v-turbo?
Utiliza https://api.tokenlab.sh/v1/chat/completions para glm-5v-turbo. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Puedo probar glm-5v-turbo antes de integrarlo?
Sí. Abrir Console inicia un borrador listo para glm-5v-turbo y conserva tu prompt tras iniciar sesión, sin perder contexto.
¿Qué operaciones soporta glm-5v-turbo?
glm-5v-turbo admite chat_completion. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.