Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

MiniMax: MiniMax-M2.5-highspeed

Modelo MiniMax de alta velocidade para codificação de baixa latência e fluxos de trabalho de agentes
Comparar modelos
minimax-m2.5-highspeed
DisponívelMiniMaxChat
Entrada / Saída
$0.60 / $2.40
Contexto
205K
Saída máxima
64K
Modalidades
Chat
Capacidades
Uso de ferramentasCache de prompts

Sobre o MiniMax-M2.5-highspeed

MiniMax-M2.5-highspeed é a opção de serviço mais rápida do MiniMax-M2.5, o modelo de fevereiro de 2026 ajustado para programação, chamada de ferramentas, busca e produtividade de escritório. A MiniMax afirma que o M2.5 e sua versão highspeed fornecem resultados idênticos, sendo que a versão highspeed é executada mais rapidamente. Ele raciocina, chama ferramentas e faz cache de prompts, visando codificação de baixa latência e fluxos de trabalho de agentes.

Pontos fortes

  • A MiniMax diz que a versão highspeed corresponde aos resultados do M2.5 enquanto gera mais rapidamente.
  • O M2.5 tem como foco a codificação, chamada de ferramentas e busca, além de trabalho de produtividade de escritório.
  • Raciocínio, uso de ferramentas e cache de prompts estão todos disponíveis.
  • Os pesos do M2.5 são publicados abertamente, para que o comportamento possa ser verificado em uma cópia auto-hospedada.

Quando usar outro modelo

  • Apenas entrada de texto, portanto, diagramas e fotos devem ser descritos em palavras.
  • Não possui modo de esquema de resposta, ao contrário do M2.1; a saída estruturada depende de prompting e validação em seu código.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoResponses API
    POST/v1/responses
    Formato da API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.5-highspeed",
        "input": "Hello!"
      }'

Preço

O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.

Especificação padrão

Por 1M Token
Preço Official
Entrada $0.60 / Saída $2.40 / Leitura de cache $0.03 / Escrita de cache $0.375
Preço Verified
—
Desconto
—
Preços de cache de prompt

Leitura de cache

Preço Official
$0.03
Preço Verified
—
Desconto
—

Escrita de cache

Preço Official
$0.375
Preço Verified
—
Desconto
—

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra MiniMax-M2.5-highspeed no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar minimax-m2.5-highspeed com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.

Casos de uso

  • Agentes de codificação de baixa latência

    Mantenha um agente responsivo enquanto ele lê arquivos, executa comandos e revisa seu plano.

  • Pipelines de busca e ferramentas

    Encadeie ferramentas de web ou banco de dados onde cada etapa do modelo aguarda um resultado de recuperação.

  • Automação de tarefas de escritório

    Redija e revise planilhas, relatórios ou textos de slides onde várias rodadas rápidas são necessárias.

Exemplos de prompt

Pesquise no repositório por cada uso do cliente descontinuado, liste os arquivos e corrija os mais simples.

Resuma os tickets deste trimestre por tema e, em seguida, redija três tópicos para uma atualização semanal.

Chame lookup_price para cada SKU na lista e relate qualquer um que tenha mudado.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Como o M2.5-highspeed difere do M2.5?

A MiniMax descreve os dois como idênticos em capacidade, diferindo apenas na velocidade. Use a versão highspeed quando o atraso entre as etapas for importante em um loop interativo ou agente.

Para que o M2.5 foi criado?

A nota de lançamento da MiniMax diz que ele alcançou resultados líderes em programação, chamada de ferramentas e busca, e produtividade de escritório. É um modelo de agente geral, em vez de um modelo apenas para codificação.

Ele suporta saída de esquema JSON estruturado?

Nenhum esquema de resposta é oferecido para este modelo, embora o uso de ferramentas seja suportado. Se você precisar de saída estritamente tipada, valide-a em seu código ou use o M2.1, que possui saída de esquema.

É código aberto?

Os pesos do M2.5 são publicados no Hugging Face sob MiniMaxAI. O nome highspeed refere-se a como o modelo é servido e quão rápido ele responde, não a um modelo diferente.

Devo usar o M2.5-highspeed ou o M2.7-highspeed?

Experimente o M2.7-highspeed para recursos de agente mais novos, como habilidades e busca dinâmica de ferramentas. Mantenha o M2.5-highspeed se seus prompts estiverem ajustados para ele e os resultados forem estáveis.

Quanto custa o MiniMax-M2.5-highspeed?

No TokenLab, MiniMax-M2.5-highspeed custa Entrada $0.60 / Saída $2.40 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do MiniMax-M2.5-highspeed?

O MiniMax-M2.5-highspeed aceita até 204.800 tokens de contexto e gera até 65.536 tokens por resposta.

Qual endpoint o MiniMax-M2.5-highspeed deve usar?

Use https://api.tokenlab.sh/v1/responses para MiniMax-M2.5-highspeed. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o MiniMax-M2.5-highspeed suporta?

MiniMax-M2.5-highspeed suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar MiniMax-M2.5-highspeed

Fontes

Revisado em 2 de out. de 2026

Mais da série MiniMax

Modelos relacionados