Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

MiniMax: MiniMax H3

O Hailuo H3 cria vídeo a partir de texto, imagens estáticas ou referências visuais. Quadros inicial e final ajudam a definir a direção de uma tomada, tornando-o útil para transformar um conceito de storyboard em uma curta sequência de movimento.
Comparar modelos
hailuo-h3
DisponívelMiniMaxVídeoAssíncrono
Preço
A partir de $0.08
Modalidades
Vídeo

Sobre o MiniMax H3

O MiniMax H3, também chamado de Hailuo H3, é o modelo de vídeo multimodal de uso geral da MiniMax e o sucessor do Hailuo 2.3. Ele gera vídeos a partir de texto, uma imagem estática, um par de quadros inicial e final, ou um conjunto de imagens, vídeos e clipes de áudio de referência. Oferece resoluções de 768p e 2K, a faixa superior da família H3, o que o diferencia do H3-Max, focado em velocidade.

Pontos fortes

  • A geração por quadros inicial e final define como uma tomada começa e termina, o que ajuda ao transformar um storyboard em movimento.
  • A geração por referência aceita imagens, clipes de vídeo curtos e clipes de áudio como orientação para o assunto, movimento e som.
  • As opções de resolução são 768p e 2K, sendo que a opção 2K está acima do H3-Max, que atinge o limite de 768p.
  • Estão disponíveis as funções de texto para vídeo e imagem para vídeo, permitindo que um único modelo cubra trabalhos baseados apenas em prompts e em imagens estáticas.
  • Os clipes duram seis ou dez segundos, tempo suficiente para uma única tomada com um início e fim claros.

Quando usar outro modelo

  • O modo de referência e o modo de primeiro/último quadro não podem ser combinados em uma única solicitação, portanto, você deve escolher entre eles a cada geração.
  • Para iteração rápida em resoluções mais baixas, a MiniMax posiciona o H3-Max como a variante mais rápida.
  • A proporção de tela é limitada a 16:9 e adaptativa, portanto, outras proporções fixas não podem ser selecionadas.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Imagem para vídeoReferência para vídeoFrames inicial e final para vídeoTexto para vídeoEndpoint do TokenLab
    POST/v1/videos/generations
    curl -X POST "https://api.tokenlab.sh/v1/videos/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "aspect_ratio": "16:9",
      "duration": 6,
      "operation": "text-to-video",
      "resolution": "768p",
      "model": "hailuo-h3",
      "prompt": "Cinematic sunrise over a calm lake with gentle camera motion."
    }'

Preço

O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.

  • Imagem para vídeoOfficial
  • Referência para vídeoOfficial
  • Frames inicial e final para vídeoOfficial
  • Texto para vídeoVerified, Official

Texto para vídeo · 768p

por segundo
Preço oficial
$0.08
Preço da TokenLab
$0.08
Desconto
—

Imagem para vídeo / Frames inicial e final para vídeo / Referência para vídeo · 768p

por segundo
Preço oficial
$0.08
Preço da TokenLab
—
Desconto
—

Texto para vídeo · 2k

por segundo
Preço oficial
$0.13
Preço da TokenLab
$0.13
Desconto
—

Imagem para vídeo / Frames inicial e final para vídeo / Referência para vídeo · 2k

por segundo
Preço oficial
$0.13
Preço da TokenLab
—
Desconto
—

Referência para vídeo · Entrada de imagem · As primeiras 5 imagens são grátis

por segundo
Preço oficial
$0.04/imagem
Preço da TokenLab
—
Desconto
—

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra MiniMax H3 no Console com um prompt pronto para editar ou enviar.

Ajude-me a criar com hailuo-h3 usando text-to-video em /v1/videos/generations. Exiba o resultado, status e custo.

Casos de uso

Indicado para
  • Multimodal
  • Texto para vídeo
  • Storyboard para tomada

    Forneça um primeiro e um último quadro e um prompt descrevendo o movimento entre eles para obter um teste de movimento que chegue a uma composição final planejada.

  • Clipes com personagens consistentes

    Forneça imagens de referência de um personagem ou produto e coloque-os em novas cenas ao longo de vários clipes.

  • Cenas com suporte a áudio

    Adicione um clipe de áudio como referência para guiar o ritmo ou a ambiência na tomada gerada.

  • Tomadas principais em alta resolução

    Renderize uma tomada principal em 2K para um cabeçalho de site ou uma prova de filme.

Exemplos de prompt

Comece na porta fechada, termine na porta aberta com a luz entrando; movimento lento de dolly para frente, corredor empoeirado.

Usando a foto de referência do tênis vermelho, mostre-o girando sobre um pedestal de concreto sob luzes de estúdio.

Um festival de lanternas de papel à noite, câmera subindo acima da multidão, brilho quente refletindo em um rio.

FAQ

Qual é a diferença entre o MiniMax H3 e o Hailuo 2.3?

O H3 é a geração multimodal mais recente. Além de texto e entrada de imagem única, ele aceita quadros inicial e final e imagens, vídeos e áudio de referência, chegando a 2K. O Hailuo 2.3 aceita um prompt e uma imagem.

Posso definir tanto o primeiro quanto o último quadro?

Sim. Forneça uma imagem inicial e uma imagem final, e o modelo fará a animação entre elas. A documentação da MiniMax trata isso como um modo separado da geração por referência.

Quais referências o H3 pode usar?

Até nove imagens, três clipes de vídeo e três clipes de áudio, de acordo com a documentação da MiniMax, com o total de clipes limitado a quinze segundos para vídeo e para áudio.

Quais resoluções ele oferece?

768p e 2K, de acordo com a documentação da MiniMax. A variante H3-Max troca a resolução máxima por velocidade e oferece 480p e 768p em vez dos tamanhos maiores.

Qual é a duração dos clipes?

Seis ou dez segundos. Escolha seis segundos para uma única ação ou revelação de produto, e dez quando a tomada precisar de um movimento de câmera ou uma mudança dentro da cena. Para sequências mais longas, gere vários clipes e junte-os em um editor.

Quanto custa o MiniMax H3?

No TokenLab, MiniMax H3 custa $0.08-$0.13 por segundo. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual endpoint o MiniMax H3 deve usar?

Use https://api.tokenlab.sh/v1/videos/generations para MiniMax H3. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o MiniMax H3 suporta?

MiniMax H3 suporta Imagem para vídeo, Referência para vídeo, Frames inicial e final para vídeo, Texto para vídeo. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar MiniMax H3

Fontes

Revisado em 2 de out. de 2026

Mais da série Hailuo

Modelos relacionados