xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- Entrada / Salida-50%
- $1.25 / $2.50$0.625 / $1.25
- Contexto
- 1M
- Salida máxima
- 128K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de prompts
Sobre Grok 4.20 Non-Reasoning
Grok 4.20 Non-Reasoning es la versión de respuesta directa del modelo 4.20 de xAI. Omite la fase de pensamiento extendido, por lo que responde rápidamente a prompts de texto e imagen y es adecuado para redacción, extracción y chat asistido por herramientas. xAI lo describe como una combinación de estricto cumplimiento de las instrucciones con una baja tasa de alucinación. Elija las variantes de razonamiento o multi-agente cuando un problema requiera un análisis deliberado.
Puntos fuertes
- Responde sin una fase de pensamiento separada, lo que mantiene la latencia baja para chats interactivos y trabajos de alto volumen.
- xAI destaca el estricto cumplimiento de las instrucciones y una baja tasa de alucinación para este modelo, útil cuando la salida debe seguir una plantilla.
- Admite llamadas a funciones y salida JSON estructurada para tuberías de extracción y asistentes basados en herramientas.
- Acepta imágenes con texto, por lo que puede leer un recibo o una captura de pantalla y responder en un solo paso.
- El almacenamiento en caché de prompts ayuda cuando muchas solicitudes reutilizan las mismas instrucciones largas o texto de referencia.
Cuándo buscar otra opción
- Sin un paso de razonamiento, es más débil en lógica de múltiples etapas o matemáticas que grok-4.20 o grok-4.7.
- No divide el trabajo entre agentes; la investigación de final abierto se sirve mejor con la variante multi-agente.
- La salida es solo texto, sin generación de imágenes, audio o video.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoResponses APIPOST/v1/responsesFormato de API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
Precios
El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.
Especificación por defecto
Por 1M Token- Precio Official
- Entrada $1.25 / Salida $2.50 / Lectura de caché $0.20
- Precio de TokenLab
- Entrada $0.625 / Salida $1.25 / Lectura de caché $0.10
- Descuento
- -50%
Lectura de caché
- Precio Official
- $0.20
- Precio de TokenLab
- $0.10
- Descuento
- -50%
| Precio OfficialPor 1M Token | Precio de TokenLabPor 1M Token | Descuento | |
|---|---|---|---|
| Especificación por defecto | Entrada $1.25 / Salida $2.50 / Lectura de caché $0.20 | Entrada $0.625 / Salida $1.25 / Lectura de caché $0.10 | -50% |
| Precios de caché de prompt | |||
| Lectura de caché | $0.20 | $0.10 | -50% |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Grok 4.20 Non-Reasoning en Console con un prompt listo para editar o enviar.
Ayúdame a probar grok-4.20-non-reasoning con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Visión
Chat de atención al cliente
Responda preguntas sobre productos y cuentas con un tono consistente, llamando a funciones de búsqueda cuando sea necesario, sin hacer que el cliente espere por una larga fase de pensamiento.
Extracción masiva de documentos
Procese miles de contratos, formularios o correos electrónicos a través de un esquema JSON fijo, confiando en el estricto seguimiento de instrucciones para mantener la consistencia de los campos.
Redacción y reescritura
Produzca borradores iniciales de correos electrónicos, resúmenes y notas de lanzamiento en un formato solicitado, luego refínelos con instrucciones de seguimiento breves.
Ejemplos de prompts
Resuma este hilo de soporte en tres puntos clave y una respuesta sugerida. Mantenga la respuesta por debajo de las 80 palabras y no prometa un reembolso.
Extraiga los nombres de las partes, la fecha de vigencia y el período de notificación de terminación de este contrato en el esquema JSON a continuación. Devuelva null para cualquier dato faltante.
Reescriba este registro de cambios para clientes no técnicos. Mantenga los encabezados, elimine los números de ticket internos y use oraciones simples.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Qué es Grok 4.20 Non-Reasoning?
Es la versión del Grok 4.20 de xAI que responde directamente en lugar de pensar primero. Lee texto e imágenes, escribe texto y admite llamadas a funciones y salidas estructuradas. Está dirigido a trabajos rápidos y pesados en instrucciones, como extracción, redacción y chat asistido por herramientas.
¿Cuándo debería usar Non-Reasoning en lugar de grok-4.20?
Úselo cuando la tarea sea clara y la respuesta sea principalmente de recuperación, reescritura o formato. Responde antes que el ID de razonamiento. Cambie a grok-4.20 cuando la respuesta necesite varios pasos de análisis, como depuración o planificación.
¿Sigue Grok 4.20 Non-Reasoning esquemas JSON?
Sí. Admite salidas estructuradas, por lo que puede proporcionar un esquema y recibir una respuesta que se ajuste a él. Combinado con el énfasis de xAI en el estricto cumplimiento de las instrucciones, esto lo convierte en un valor predeterminado razonable para trabajos de extracción y clasificación.
¿Puede aceptar entrada de imágenes?
Sí, las imágenes se pueden enviar junto con el texto, por ejemplo, un formulario fotografiado o una captura de pantalla de la interfaz de usuario. La respuesta es texto. El modelo no puede crear ni editar imágenes.
¿Funciona con un cliente existente al estilo OpenAI?
Sí. El código de cliente existente al estilo OpenAI funciona cambiando solo el nombre del modelo, con las definiciones de herramientas y los esquemas JSON enviados en los campos habituales como antes.
¿Cuánto cuesta Grok 4.20 Non-Reasoning?
En TokenLab, Grok 4.20 Non-Reasoning cuesta Entrada $0.625 / Salida $1.25 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Grok 4.20 Non-Reasoning?
Grok 4.20 Non-Reasoning admite hasta 1.000.000 tokens de contexto y genera hasta 131.072 tokens por respuesta.
¿Qué endpoint debe usar Grok 4.20 Non-Reasoning?
Utiliza https://api.tokenlab.sh/v1/responses para Grok 4.20 Non-Reasoning. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Grok 4.20 Non-Reasoning?
Grok 4.20 Non-Reasoning admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Grok 4.20 Non-Reasoning
Fuentes
Revisado el 2 oct 2026