MiniMax: MiniMax-M2.5-highspeed
minimax-m2.5-highspeed- Entrada / Saída
- $0.60 / $2.40
- Contexto
- 205K
- Saída máxima
- 64K
- Modalidades
- Chat
- Capacidades
- Uso de ferramentasCache de prompts
Sobre o MiniMax-M2.5-highspeed
MiniMax-M2.5-highspeed é a opção de serviço mais rápida do MiniMax-M2.5, o modelo de fevereiro de 2026 ajustado para programação, chamada de ferramentas, busca e produtividade de escritório. A MiniMax afirma que o M2.5 e sua versão highspeed fornecem resultados idênticos, sendo que a versão highspeed é executada mais rapidamente. Ele raciocina, chama ferramentas e faz cache de prompts, visando codificação de baixa latência e fluxos de trabalho de agentes.
Pontos fortes
- A MiniMax diz que a versão highspeed corresponde aos resultados do M2.5 enquanto gera mais rapidamente.
- O M2.5 tem como foco a codificação, chamada de ferramentas e busca, além de trabalho de produtividade de escritório.
- Raciocínio, uso de ferramentas e cache de prompts estão todos disponíveis.
- Os pesos do M2.5 são publicados abertamente, para que o comportamento possa ser verificado em uma cópia auto-hospedada.
Quando usar outro modelo
- Apenas entrada de texto, portanto, diagramas e fotos devem ser descritos em palavras.
- Não possui modo de esquema de resposta, ao contrário do M2.1; a saída estruturada depende de prompting e validação em seu código.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoResponses APIPOST/v1/responsesFormato da API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m2.5-highspeed", "input": "Hello!" }'
Preço
O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.
Especificação padrão
Por 1M Token- Preço Official
- Entrada $0.60 / Saída $2.40 / Leitura de cache $0.03 / Escrita de cache $0.375
- Preço Verified
- —
- Desconto
- —
Leitura de cache
- Preço Official
- $0.03
- Preço Verified
- —
- Desconto
- —
Escrita de cache
- Preço Official
- $0.375
- Preço Verified
- —
- Desconto
- —
| Preço OfficialPor 1M Token | Preço VerifiedPor 1M Token | Desconto | |
|---|---|---|---|
| Especificação padrão | Entrada $0.60 / Saída $2.40 / Leitura de cache $0.03 / Escrita de cache $0.375 | — | — |
| Preços de cache de prompt | |||
| Leitura de cache | $0.03 | — | — |
| Escrita de cache | $0.375 | — | — |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra MiniMax-M2.5-highspeed no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar minimax-m2.5-highspeed com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.
Casos de uso
Agentes de codificação de baixa latência
Mantenha um agente responsivo enquanto ele lê arquivos, executa comandos e revisa seu plano.
Pipelines de busca e ferramentas
Encadeie ferramentas de web ou banco de dados onde cada etapa do modelo aguarda um resultado de recuperação.
Automação de tarefas de escritório
Redija e revise planilhas, relatórios ou textos de slides onde várias rodadas rápidas são necessárias.
Exemplos de prompt
Pesquise no repositório por cada uso do cliente descontinuado, liste os arquivos e corrija os mais simples.
Resuma os tickets deste trimestre por tema e, em seguida, redija três tópicos para uma atualização semanal.
Chame lookup_price para cada SKU na lista e relate qualquer um que tenha mudado.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Como o M2.5-highspeed difere do M2.5?
A MiniMax descreve os dois como idênticos em capacidade, diferindo apenas na velocidade. Use a versão highspeed quando o atraso entre as etapas for importante em um loop interativo ou agente.
Para que o M2.5 foi criado?
A nota de lançamento da MiniMax diz que ele alcançou resultados líderes em programação, chamada de ferramentas e busca, e produtividade de escritório. É um modelo de agente geral, em vez de um modelo apenas para codificação.
Ele suporta saída de esquema JSON estruturado?
Nenhum esquema de resposta é oferecido para este modelo, embora o uso de ferramentas seja suportado. Se você precisar de saída estritamente tipada, valide-a em seu código ou use o M2.1, que possui saída de esquema.
É código aberto?
Os pesos do M2.5 são publicados no Hugging Face sob MiniMaxAI. O nome highspeed refere-se a como o modelo é servido e quão rápido ele responde, não a um modelo diferente.
Devo usar o M2.5-highspeed ou o M2.7-highspeed?
Experimente o M2.7-highspeed para recursos de agente mais novos, como habilidades e busca dinâmica de ferramentas. Mantenha o M2.5-highspeed se seus prompts estiverem ajustados para ele e os resultados forem estáveis.
Quanto custa o MiniMax-M2.5-highspeed?
No TokenLab, MiniMax-M2.5-highspeed custa Entrada $0.60 / Saída $2.40 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do MiniMax-M2.5-highspeed?
O MiniMax-M2.5-highspeed aceita até 204.800 tokens de contexto e gera até 65.536 tokens por resposta.
Qual endpoint o MiniMax-M2.5-highspeed deve usar?
Use https://api.tokenlab.sh/v1/responses para MiniMax-M2.5-highspeed. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o MiniMax-M2.5-highspeed suporta?
MiniMax-M2.5-highspeed suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar MiniMax-M2.5-highspeed
Fontes
Revisado em 2 de out. de 2026