Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

MiniMax: MiniMax-M2.5-highspeed

Modelo MiniMax de alta velocidad para codificación de baja latencia y flujos de trabajo de agentes
Comparar modelos
minimax-m2.5-highspeed
DisponibleMiniMaxChat
Entrada / Salida
$0.60 / $2.40
Contexto
205K
Salida máxima
64K
Modalidades
Chat
Capacidades
Uso de herramientasCaché de prompts

Sobre MiniMax-M2.5-highspeed

MiniMax-M2.5-highspeed es la opción de servicio más rápida de MiniMax-M2.5, el modelo de febrero de 2026 ajustado para programación, llamadas a herramientas, búsqueda y productividad de oficina. MiniMax afirma que M2.5 y su versión highspeed ofrecen resultados idénticos, siendo la versión highspeed más rápida en su ejecución. Razona, llama a herramientas y utiliza caché de prompts, con el objetivo de lograr una baja latencia en tareas de codificación y flujos de trabajo de agentes.

Puntos fuertes

  • MiniMax indica que la versión highspeed iguala los resultados de M2.5 mientras genera contenido más rápido.
  • M2.5 se enfoca en la codificación, llamadas a herramientas y búsqueda, además de tareas de productividad de oficina.
  • El razonamiento, el uso de herramientas y el caché de prompts están disponibles.
  • Los pesos de M2.5 se publican abiertamente, por lo que el comportamiento puede verificarse con una copia autohospedada.

Cuándo buscar otra opción

  • Solo admite entrada de texto, por lo que los diagramas y fotos deben describirse con palabras.
  • No cuenta con modo de esquema de respuesta, a diferencia de M2.1; la salida estructurada depende de la creación de prompts y la validación en su código.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoResponses API
    POST/v1/responses
    Formato de API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

Precios

El precio Verified se aplica a Verified, que cuesta menos en la mayoría de los modelos. El precio Official es el precio publicado por el fabricante del modelo y se aplica a la ruta Official, más fiable. Auto factura la ruta que completa la solicitud.

Especificación por defecto

Por 1M Token
Precio Official
Entrada $0.60 / Salida $2.40 / Lectura de caché $0.03 / Escritura de caché $0.375
Precio Verified
—
Descuento
—
Precios de caché de prompt

Lectura de caché

Precio Official
$0.03
Precio Verified
—
Descuento
—

Escritura de caché

Precio Official
$0.375
Precio Verified
—
Descuento
—

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre MiniMax-M2.5-highspeed en Console con un prompt listo para editar o enviar.

Ayúdame a probar minimax-m2.5-highspeed con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.

Casos de uso

  • Agentes de codificación de baja latencia

    Mantenga a un agente receptivo mientras lee archivos, ejecuta comandos y revisa su plan.

  • Canalizaciones de búsqueda y herramientas

    Encadene herramientas web o de base de datos donde cada paso del modelo espera un resultado de recuperación.

  • Automatización de tareas de oficina

    Redacte y revise hojas de cálculo, informes o texto de diapositivas donde se necesiten varias rondas rápidas.

Ejemplos de prompts

Busque en el repositorio cada uso del cliente obsoleto, enumere los archivos y aplique parches a los más sencillos.

Resuma los tickets de este trimestre por tema y luego redacte tres puntos clave para una actualización semanal.

Llame a lookup_price para cada SKU en la lista e informe sobre cualquiera que haya cambiado.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿En qué se diferencia M2.5-highspeed de M2.5?

MiniMax describe ambos como idénticos en capacidad, diferenciándose solo en la velocidad. Utilice la versión highspeed cuando el retraso entre pasos sea importante en un bucle interactivo o un agente.

¿Para qué se creó M2.5?

La nota de lanzamiento de MiniMax dice que alcanzó resultados líderes en programación, llamadas a herramientas, búsqueda y productividad de oficina. Es un modelo de agente general, no solo para codificación.

¿Admite salida de esquema JSON estructurado?

No se ofrece esquema de respuesta para este modelo, aunque sí se admite el uso de herramientas. Si necesita una salida estrictamente tipada, valídela en su código o utilice M2.1, que cuenta con salida de esquema.

¿Es de código abierto?

Los pesos de M2.5 se publican en Hugging Face bajo MiniMaxAI. El nombre highspeed se refiere a cómo se sirve el modelo y qué tan rápido responde, no a un modelo diferente.

¿Debo usar M2.5-highspeed o M2.7-highspeed?

Pruebe M2.7-highspeed para funciones de agente más nuevas, como habilidades y búsqueda dinámica de herramientas. Mantenga M2.5-highspeed si sus prompts están ajustados para él y los resultados son estables.

¿Cuánto cuesta MiniMax-M2.5-highspeed?

En TokenLab, MiniMax-M2.5-highspeed cuesta Entrada $0.60 / Salida $2.40 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de MiniMax-M2.5-highspeed?

MiniMax-M2.5-highspeed admite hasta 204.800 tokens de contexto y genera hasta 65.536 tokens por respuesta.

¿Qué endpoint debe usar MiniMax-M2.5-highspeed?

Utiliza https://api.tokenlab.sh/v1/responses para MiniMax-M2.5-highspeed. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta MiniMax-M2.5-highspeed?

MiniMax-M2.5-highspeed admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar MiniMax-M2.5-highspeed

Fuentes

Revisado el 2 oct 2026

Más de MiniMax

Modelos relacionados