Moonshot: Kimi K3
kimi-k3- Entrada / Salida
- $3.00 / $15.00
- Contexto
- 1M
- Salida máxima
- 128K
- Modalidades
- VisiónChat
- Capacidades
- Uso de herramientasCaché de promptsRazonamiento
Sobre Kimi K3
Kimi K3 es el modelo insignia de pesos abiertos de Moonshot AI, lanzado en julio de 2026: un modelo de mezcla de expertos (MoE) de 2.8 billones de parámetros con entrada nativa de imagen y video y un contexto de un millón de tokens. El pensamiento está siempre activo con esfuerzo bajo, alto o máximo. Utiliza Kimi Delta Attention y activa 16 de 896 expertos por token. Moonshot lo diseñó para agentes de largo alcance, bases de código grandes y trabajo de conocimiento.
Puntos fuertes
- El esfuerzo de razonamiento se puede configurar en bajo, alto o máximo, por lo que un solo modelo cubre desde respuestas rápidas hasta la resolución de problemas complejos.
- Contexto de un millón de tokens, orientado a bases de código grandes e historiales de agentes extensos.
- Entrada nativa de imagen y video, por lo que gráficos, capturas de pantalla y grabaciones pueden ser parte de la tarea.
- Admite salida JSON, llamadas a herramientas con carga dinámica, continuación de prefijo y almacenamiento en caché de contexto automático.
Cuándo buscar otra opción
- El pensamiento está siempre activo, por lo que los turnos triviales consumen más tiempo que en un modelo sin capacidad de pensamiento.
- Un modelo de este tamaño es pesado para autoalojarse, incluso aunque los pesos sean abiertos.
- El texto es la única salida; utilice un modelo separado para imágenes o voz.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoResponses APIPOST/v1/responsesFormato de API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "kimi-k3", "input": "Hello!" }'
Precios
El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.
Default
Por 1M Token- Precio Official
- Entrada $3.00 / Salida $15.00 / Lectura de caché $0.30 / Escritura de caché $3.00 / Texto Entrada $3.00 / Texto Salida $15.00
- Precio Verified
- —
- Descuento
- —
Lectura de caché
- Precio Official
- $0.30
- Precio Verified
- —
- Descuento
- —
Escritura de caché
- Precio Official
- $3.00
- Precio Verified
- —
- Descuento
- —
| Precio OfficialPor 1M Token | Precio VerifiedPor 1M Token | Descuento | |
|---|---|---|---|
| Default | Entrada $3.00 / Salida $15.00 / Lectura de caché $0.30 / Escritura de caché $3.00 / Texto Entrada $3.00 / Texto Salida $15.00 | — | — |
| Precios de caché de prompt | |||
| Lectura de caché | $0.30 | — | — |
| Escritura de caché | $3.00 | — | — |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 99,2%
- Solicitudes 30 días
- 100+
- Última actividad
- hace 6 minutos
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre Kimi K3 en Console con un prompt listo para editar o enviar.
Ayúdame a probar kimi-k3 con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Razonamiento
- Visión
Agentes de largo alcance
Ejecute agentes de investigación o ingeniería que realicen cientos de llamadas a herramientas y necesiten recordar resultados anteriores a lo largo de una sesión muy extensa.
Trabajo con bases de código grandes
Navegue y modifique un repositorio grande cargando gran parte de él en el contexto en lugar de depender solo de la recuperación.
Análisis de video y gráficos
Haga preguntas sobre una demostración grabada o un gráfico denso y reciba hallazgos que citen lo que aparece en pantalla.
Automatización del trabajo de conocimiento
Redacte informes y análisis a partir de grandes conjuntos de documentos, utilizando herramientas para obtener datos y verificar cifras.
Ejemplos de prompts
Revise el archivo adjunto de 600 páginas y enumere cada transacción con partes relacionadas junto con su número de página.
Lea este repositorio y explique cómo fluye una solicitud desde el enrutador hasta la base de datos, nombrando cada archivo.
Vea este video de demostración del producto y escriba el informe de error para el paso donde el formulario se restablece.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Qué es Kimi K3?
El modelo insignia de pesos abiertos de Moonshot AI, con 2.8 billones de parámetros en un diseño de mezcla de expertos. Lee texto, imágenes y video, tiene un contexto de un millón de tokens y piensa antes de responder con un esfuerzo ajustable.
¿Cuáles son los niveles de esfuerzo de razonamiento?
Bajo, alto y máximo. El pensamiento está siempre activo, y el esfuerzo determina cuánto delibera el modelo. Use bajo para solicitudes rutinarias y máximo para depuración, planificación o análisis complejos.
¿Es Kimi K3 de código abierto?
Moonshot publicó los pesos después del lanzamiento de la API, por lo que puede autoalojarlo si tiene el hardware. Llamarlo a través de una API evita ese costo y le permite cambiar de modelo sin necesidad de volver a implementar.
¿Admite entrada de video?
Sí. Moonshot describe soporte nativo para imágenes y video, lo cual es adecuado para grabaciones de pantalla, demostraciones y gráficos junto con instrucciones de texto. La salida sigue siendo texto, por lo que los hallazgos se devuelven como respuestas escritas.
¿En qué se diferencia de Kimi K2.6?
K3 es el modelo más nuevo y mucho más grande, con una ventana de un millón de tokens, niveles de esfuerzo configurables y una escala más eficiente según Moonshot. K2.6 tiene un contexto más corto y no cuenta con configuración de esfuerzo.
¿Cuánto cuesta Kimi K3?
En TokenLab, Kimi K3 cuesta Entrada $3.00 / Salida $15.00 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de Kimi K3?
Kimi K3 admite hasta 1.048.576 tokens de contexto y genera hasta 131.072 tokens por respuesta.
¿Qué endpoint debe usar Kimi K3?
Utiliza https://api.tokenlab.sh/v1/responses para Kimi K3. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta Kimi K3?
Kimi K3 admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar Kimi K3
Fuentes
Revisado el 2 oct 2026