Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

MiniMax: MiniMax-M3

Modelo multimodal MiniMax para codificação de longo contexto, percepção e planejamento de agentes
Comparar modelos
minimax-m3
DisponívelMiniMaxChat
Entrada / Saída
$0.30 / $1.20
Contexto
1M
Saída máxima
512K
Modalidades
Chat
Capacidades
Uso de ferramentasCache de prompts

Sobre o MiniMax-M3

O MiniMax-M3 é o modelo de pesos abertos da MiniMax de junho de 2026 para codificação, trabalho agentico e tarefas de contexto longo. Ele utiliza o MiniMax Sparse Attention para manter entradas muito longas acessíveis, raciocina antes de responder, chama ferramentas e faz cache de prompts. É o modelo de fronteira da série M da empresa e o sucessor do M2.7.

Pontos fortes

  • O MiniMax Sparse Attention reduz o processamento por token em entradas muito longas em comparação com a geração anterior.
  • Visa a decomposição autônoma de tarefas, invocação de ferramentas e raciocínio em várias etapas para agentes.
  • Os pesos abertos são publicados pela MiniMax, para que o comportamento possa ser verificado em uma cópia auto-hospedada.
  • Raciocínio, uso de ferramentas e cache de prompts podem ser ativados para longos loops de agentes.

Quando usar outro modelo

  • Apenas entrada de texto, portanto, gráficos e capturas de tela não podem ser lidos diretamente.
  • O raciocínio e a entrada muito longa tornam as solicitações mais lentas do que os modelos M2.x de alta velocidade.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoResponses API
    POST/v1/responses
    Formato da API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m3",
        "input": "Hello!"
      }'

Preço

O preço Verified vale para o Verified, que custa menos na maioria dos modelos. O preço Official é o preço publicado pelo fabricante do modelo e vale para a rota Official, mais confiável. O Auto cobra pela rota que conclui a solicitação.

Entrada tokens <= 512K

Por 1M Token
Preço Official
Entrada $0.30 / Saída $1.20 / Leitura de cache $0.06
Preço Verified
—
Desconto
—

Entrada tokens > 512K

Por 1M Token
Preço Official
Entrada $0.60 / Saída $2.40 / Leitura de cache $0.12
Preço Verified
—
Desconto
—
Preços de cache de prompt

Leitura de cache

Preço Official
$0.06
Preço Verified
—
Desconto
—

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
Taxa de sucesso em 30 dias
100,0%
Requisições em 30 dias
100+
Última atividade
anteontem

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra MiniMax-M3 no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar minimax-m3 com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.

Casos de uso

  • Trabalho em repositório completo

    Carregue uma grande base de código e peça ao modelo para rastrear uma alteração entre módulos antes de editar.

  • Agentes de planejamento

    Dê a um agente um conjunto de ferramentas e um objetivo, e deixe-o decompor a tarefa e chamar as ferramentas passo a passo.

  • Análise de documentos longos

    Revise transcrições, especificações ou documentos extensos em uma única passagem, em vez de dividi-los em partes.

Exemplos de prompt

Aqui está o repositório completo. Onde a lógica de nova tentativa está implementada e o que quebra se eu alterar seu backoff?

Aqui está a linha do tempo do incidente e os logs de serviço. Escreva as etapas para reproduzir o bug e nomeie o módulo provavelmente defeituoso.

Planeje como dividir este monólito em três serviços e nomeie a primeira chamada de ferramenta que você faria para cada um.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

O que torna o MiniMax-M3 diferente do M2.7?

A MiniMax apresenta o M3 como uma nova geração construída em torno de atenção esparsa para contexto muito longo e voltada para codificação e tarefas agenticas, enquanto o M2.7 visa estruturas de agentes anteriores.

O MiniMax-M3 tem pesos abertos?

A MiniMax publica o M3 como um modelo de pesos abertos, para que você possa auto-hospedá-lo se as regras de seus dados exigirem isso. Leia a licença no cartão do modelo antes de fazê-lo.

Ele aceita imagens e vídeo?

Não. O MiniMax-M3 aceita apenas entrada de texto, portanto, use um modelo com entrada de imagem quando precisar ler capturas de tela, gráficos, diagramas ou quadros de vídeo diretamente.

Ele pode usar ferramentas?

Sim. Ele chama ferramentas, e a MiniMax o direciona para o planejamento de agentes, onde uma tarefa é dividida em etapas e uma ferramenta é invocada em cada uma. Passe suas definições de ferramenta com a solicitação e deixe o modelo decidir quando chamá-las.

Quando devo usar o M3 em vez de um modelo M2.x de alta velocidade?

Escolha o M3 para entradas muito longas ou planejamento de agentes mais difícil. Escolha uma variante M2.x de alta velocidade quando o atraso de cada turno for mais importante do que a profundidade do raciocínio.

Quanto custa o MiniMax-M3?

No TokenLab, MiniMax-M3 custa Entrada $0.30 / Saída $1.20 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do MiniMax-M3?

O MiniMax-M3 aceita até 1.048.576 tokens de contexto e gera até 524.288 tokens por resposta.

Qual endpoint o MiniMax-M3 deve usar?

Use https://api.tokenlab.sh/v1/responses para MiniMax-M3. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o MiniMax-M3 suporta?

MiniMax-M3 suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar MiniMax-M3

Fontes

Revisado em 2 de out. de 2026

Mais da série MiniMax

Modelos relacionados