Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Moonshot: Kimi K3

Modelo multimodal Kimi con 1M de contexto y razonamiento de máximo esfuerzo activable para trabajos de agentes a largo plazo
Comparar modelos
kimi-k3
DisponibleMoonshotChat
Entrada / Salida
$3.00 / $15.00
Contexto
1M
Salida máxima
128K
Modalidades
VisiónChat
Capacidades
Uso de herramientasCaché de promptsRazonamiento

Sobre Kimi K3

Kimi K3 es el modelo insignia de pesos abiertos de Moonshot AI, lanzado en julio de 2026: un modelo de mezcla de expertos (MoE) de 2.8 billones de parámetros con entrada nativa de imagen y video y un contexto de un millón de tokens. El pensamiento está siempre activo con esfuerzo bajo, alto o máximo. Utiliza Kimi Delta Attention y activa 16 de 896 expertos por token. Moonshot lo diseñó para agentes de largo alcance, bases de código grandes y trabajo de conocimiento.

Puntos fuertes

  • El esfuerzo de razonamiento se puede configurar en bajo, alto o máximo, por lo que un solo modelo cubre desde respuestas rápidas hasta la resolución de problemas complejos.
  • Contexto de un millón de tokens, orientado a bases de código grandes e historiales de agentes extensos.
  • Entrada nativa de imagen y video, por lo que gráficos, capturas de pantalla y grabaciones pueden ser parte de la tarea.
  • Admite salida JSON, llamadas a herramientas con carga dinámica, continuación de prefijo y almacenamiento en caché de contexto automático.

Cuándo buscar otra opción

  • El pensamiento está siempre activo, por lo que los turnos triviales consumen más tiempo que en un modelo sin capacidad de pensamiento.
  • Un modelo de este tamaño es pesado para autoalojarse, incluso aunque los pesos sean abiertos.
  • El texto es la única salida; utilice un modelo separado para imágenes o voz.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoResponses API
    POST/v1/responses
    Formato de API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "kimi-k3",
        "input": "Hello!"
      }'

Precios

El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.

Default

Por 1M Token
Precio Official
Entrada $3.00 / Salida $15.00 / Lectura de caché $0.30 / Escritura de caché $3.00 / Texto Entrada $3.00 / Texto Salida $15.00
Precio Verified
—
Descuento
—
Precios de caché de prompt

Lectura de caché

Precio Official
$0.30
Precio Verified
—
Descuento
—

Escritura de caché

Precio Official
$3.00
Precio Verified
—
Descuento
—

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
99,2%
Solicitudes 30 días
100+
Última actividad
hace 6 minutos

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Kimi K3 en Console con un prompt listo para editar o enviar.

Ayúdame a probar kimi-k3 con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Razonamiento
  • Visión
  • Agentes de largo alcance

    Ejecute agentes de investigación o ingeniería que realicen cientos de llamadas a herramientas y necesiten recordar resultados anteriores a lo largo de una sesión muy extensa.

  • Trabajo con bases de código grandes

    Navegue y modifique un repositorio grande cargando gran parte de él en el contexto en lugar de depender solo de la recuperación.

  • Análisis de video y gráficos

    Haga preguntas sobre una demostración grabada o un gráfico denso y reciba hallazgos que citen lo que aparece en pantalla.

  • Automatización del trabajo de conocimiento

    Redacte informes y análisis a partir de grandes conjuntos de documentos, utilizando herramientas para obtener datos y verificar cifras.

Ejemplos de prompts

Revise el archivo adjunto de 600 páginas y enumere cada transacción con partes relacionadas junto con su número de página.

Lea este repositorio y explique cómo fluye una solicitud desde el enrutador hasta la base de datos, nombrando cada archivo.

Vea este video de demostración del producto y escriba el informe de error para el paso donde el formulario se restablece.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Qué es Kimi K3?

El modelo insignia de pesos abiertos de Moonshot AI, con 2.8 billones de parámetros en un diseño de mezcla de expertos. Lee texto, imágenes y video, tiene un contexto de un millón de tokens y piensa antes de responder con un esfuerzo ajustable.

¿Cuáles son los niveles de esfuerzo de razonamiento?

Bajo, alto y máximo. El pensamiento está siempre activo, y el esfuerzo determina cuánto delibera el modelo. Use bajo para solicitudes rutinarias y máximo para depuración, planificación o análisis complejos.

¿Es Kimi K3 de código abierto?

Moonshot publicó los pesos después del lanzamiento de la API, por lo que puede autoalojarlo si tiene el hardware. Llamarlo a través de una API evita ese costo y le permite cambiar de modelo sin necesidad de volver a implementar.

¿Admite entrada de video?

Sí. Moonshot describe soporte nativo para imágenes y video, lo cual es adecuado para grabaciones de pantalla, demostraciones y gráficos junto con instrucciones de texto. La salida sigue siendo texto, por lo que los hallazgos se devuelven como respuestas escritas.

¿En qué se diferencia de Kimi K2.6?

K3 es el modelo más nuevo y mucho más grande, con una ventana de un millón de tokens, niveles de esfuerzo configurables y una escala más eficiente según Moonshot. K2.6 tiene un contexto más corto y no cuenta con configuración de esfuerzo.

¿Cuánto cuesta Kimi K3?

En TokenLab, Kimi K3 cuesta Entrada $3.00 / Salida $15.00 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de Kimi K3?

Kimi K3 admite hasta 1.048.576 tokens de contexto y genera hasta 131.072 tokens por respuesta.

¿Qué endpoint debe usar Kimi K3?

Utiliza https://api.tokenlab.sh/v1/responses para Kimi K3. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Kimi K3?

Kimi K3 admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Kimi K3

Fuentes

Revisado el 2 oct 2026

Más de Kimi

Modelos relacionados