MiniMax: MiniMax-M3
minimax-m3- Entrada / Saída
- $0.30 / $1.20
- Contexto
- 1M
- Saída máxima
- 512K
- Modalidades
- Chat
- Capacidades
- Uso de ferramentasCache de prompts
Sobre o MiniMax-M3
O MiniMax-M3 é o modelo de pesos abertos da MiniMax de junho de 2026 para codificação, trabalho agentico e tarefas de contexto longo. Ele utiliza o MiniMax Sparse Attention para manter entradas muito longas acessíveis, raciocina antes de responder, chama ferramentas e faz cache de prompts. É o modelo de fronteira da série M da empresa e o sucessor do M2.7.
Pontos fortes
- O MiniMax Sparse Attention reduz o processamento por token em entradas muito longas em comparação com a geração anterior.
- Visa a decomposição autônoma de tarefas, invocação de ferramentas e raciocínio em várias etapas para agentes.
- Os pesos abertos são publicados pela MiniMax, para que o comportamento possa ser verificado em uma cópia auto-hospedada.
- Raciocínio, uso de ferramentas e cache de prompts podem ser ativados para longos loops de agentes.
Quando usar outro modelo
- Apenas entrada de texto, portanto, gráficos e capturas de tela não podem ser lidos diretamente.
- O raciocínio e a entrada muito longa tornam as solicitações mais lentas do que os modelos M2.x de alta velocidade.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoResponses APIPOST/v1/responsesFormato da API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m3", "input": "Hello!" }'
Preço
O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.
Entrada tokens <= 512K
Por 1M Token- Preço Official
- Entrada $0.30 / Saída $1.20 / Leitura de cache $0.06
- Preço Verified
- —
- Desconto
- —
Entrada tokens > 512K
Por 1M Token- Preço Official
- Entrada $0.60 / Saída $2.40 / Leitura de cache $0.12
- Preço Verified
- —
- Desconto
- —
Leitura de cache
- Preço Official
- $0.06
- Preço Verified
- —
- Desconto
- —
| Preço OfficialPor 1M Token | Preço VerifiedPor 1M Token | Desconto | |
|---|---|---|---|
| Entrada tokens <= 512K | Entrada $0.30 / Saída $1.20 / Leitura de cache $0.06 | — | — |
| Entrada tokens > 512K | Entrada $0.60 / Saída $2.40 / Leitura de cache $0.12 | — | — |
| Preços de cache de prompt | |||
| Leitura de cache | $0.06 | — | — |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 100,0%
- Requisições em 30 dias
- 100+
- Última atividade
- anteontem
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra MiniMax-M3 no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar minimax-m3 com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.
Casos de uso
Trabalho em repositório completo
Carregue uma grande base de código e peça ao modelo para rastrear uma alteração entre módulos antes de editar.
Agentes de planejamento
Dê a um agente um conjunto de ferramentas e um objetivo, e deixe-o decompor a tarefa e chamar as ferramentas passo a passo.
Análise de documentos longos
Revise transcrições, especificações ou documentos extensos em uma única passagem, em vez de dividi-los em partes.
Exemplos de prompt
Aqui está o repositório completo. Onde a lógica de nova tentativa está implementada e o que quebra se eu alterar seu backoff?
Aqui está a linha do tempo do incidente e os logs de serviço. Escreva as etapas para reproduzir o bug e nomeie o módulo provavelmente defeituoso.
Planeje como dividir este monólito em três serviços e nomeie a primeira chamada de ferramenta que você faria para cada um.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
O que torna o MiniMax-M3 diferente do M2.7?
A MiniMax apresenta o M3 como uma nova geração construída em torno de atenção esparsa para contexto muito longo e voltada para codificação e tarefas agenticas, enquanto o M2.7 visa estruturas de agentes anteriores.
O MiniMax-M3 tem pesos abertos?
A MiniMax publica o M3 como um modelo de pesos abertos, para que você possa auto-hospedá-lo se as regras de seus dados exigirem isso. Leia a licença no cartão do modelo antes de fazê-lo.
Ele aceita imagens e vídeo?
Não. O MiniMax-M3 aceita apenas entrada de texto, portanto, use um modelo com entrada de imagem quando precisar ler capturas de tela, gráficos, diagramas ou quadros de vídeo diretamente.
Ele pode usar ferramentas?
Sim. Ele chama ferramentas, e a MiniMax o direciona para o planejamento de agentes, onde uma tarefa é dividida em etapas e uma ferramenta é invocada em cada uma. Passe suas definições de ferramenta com a solicitação e deixe o modelo decidir quando chamá-las.
Quando devo usar o M3 em vez de um modelo M2.x de alta velocidade?
Escolha o M3 para entradas muito longas ou planejamento de agentes mais difícil. Escolha uma variante M2.x de alta velocidade quando o atraso de cada turno for mais importante do que a profundidade do raciocínio.
Quanto custa o MiniMax-M3?
No TokenLab, MiniMax-M3 custa Entrada $0.30 / Saída $1.20 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do MiniMax-M3?
O MiniMax-M3 aceita até 1.048.576 tokens de contexto e gera até 524.288 tokens por resposta.
Qual endpoint o MiniMax-M3 deve usar?
Use https://api.tokenlab.sh/v1/responses para MiniMax-M3. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o MiniMax-M3 suporta?
MiniMax-M3 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar MiniMax-M3
Fontes
Revisado em 2 de out. de 2026