A MiniMax abriu os pesos do H3, o gerador de vídeo que já sai com som. Dá pra rodar na sua máquina, sem servidor e sem assinatura, e este guia é o caminho.
Só que a parte mais útil não é o passo a passo. É a peneira, porque metade das pessoas que tentar não vai conseguir rodar, e é melhor descobrir isso agora do que depois de três horas baixando coisa.
Então a peneira vem primeiro.
1. A peneira: você consegue rodar isso?
Responda três perguntas antes de baixar qualquer coisa.
Você tem uma placa de vídeo dedicada? Não é o vídeo que vem junto do processador, é uma placa separada, NVIDIA ou AMD. Se o seu computador é um notebook de trabalho comum, um Mac, ou um PC sem placa de jogo, a resposta é não, e o resto do guia não vai funcionar. Pula pra última seção, que é onde estão as saídas.
Quanta memória de vídeo ela tem? É a VRAM, e é diferente da memória do computador. O projeto que faz o H3 rodar em casa declara funcionar com a partir de 6 GB de VRAM em modelos selecionados. Abaixo disso, esqueça. Pra descobrir a sua no Windows: aperte Ctrl+Shift+Esc, aba Desempenho, clique na GPU, e olhe "Memória de GPU dedicada".
Qual é o modelo da placa? O suporte declarado cobre NVIDIA das linhas GTX 10XX, 16XX, RTX 20XX, 30XX, 40XX, 50XX, e AMD nas arquiteturas RDNA 2, 3, 3.5 e 4. Mas tem um detalhe que decide na prática: os arquivos comprimidos que fazem o H3 caber em placa pequena usam aceleração que exige RTX série 30 ou mais nova. Numa placa mais velha que isso, mesmo com VRAM suficiente, você vai por um caminho mais lento e mais pesado.
Traduzindo pro português: se a sua placa é uma RTX 3060 ou mais nova, você está bem. Entre uma GTX 1660 e uma RTX 2080, dá, mas com sofrimento. Abaixo, não.
2. O que o H3 faz, com os números da própria MiniMax
Conferido hoje no anúncio oficial:
- Cenas de até 15 segundos
- 24 quadros por segundo
- Áudio estéreo nativo de 32 kHz, gerado junto com a imagem, não colado depois
- Resolução de até 2K, com o lado menor em 768 pixels por padrão
- Entrada por texto, imagem ou vídeo de referência
- Diálogo com suporte estável em 11 idiomas, incluindo português
O ponto que separa ele dos outros é o áudio nascer junto. A fala sai sincronizada com a boca e a trilha combina com a cena porque foram geradas na mesma passada, não em duas etapas coladas no fim.
3. O porém, que quase ninguém está contando
O que a MiniMax abriu foi o modelo base. O sistema completo tem três módulos, e o que entrega os 2K não é um deles.
Palavras da própria página do anúncio sobre esse módulo: "este módulo ainda não é de código aberto. Vamos liberá-lo quando estiver pronto."
Duas leituras honestas disso. A primeira: hoje, na sua máquina, você não tira 2K. A segunda, e é justa com eles: eles dizem que pretendem abrir, não que vão segurar pra sempre. Quem afirma que é "totalmente aberto e de graça" está simplificando, e quem afirma que "abriram só a casca pra vender API" também.
E vale dizer o que não dá pra afirmar: circula por aí que o H3 seria "o melhor modelo multimodal aberto do mundo", batendo o do Google. O ranking que sustentaria isso eu não consegui abrir. Sem fonte, não entra aqui.
4. O caminho fácil: três instaladores
O que faz o H3 rodar em casa é um projeto chamado WanGP, que empacota vários modelos de vídeo numa interface web e cuida da parte chata. Ele tem três formas de instalar sem digitar comando nenhum.
Opção A, a mais fácil no Windows: o Wan2GP Desktop. É um programa com janela, feito pelo GKArtist. Ele instala, atualiza e roda o WanGP de um lugar só, e resolve sozinho o Git, o Python, o CUDA e o PyTorch, que é exatamente a parte onde a maioria desiste. O próprio README do projeto principal chama isso de o jeito mais fácil de começar no Windows. github.com/GKartist75/wan2gp-desktop
Opção B: os scripts de um clique do próprio projeto. No repositório tem scripts\install.bat para Windows e scripts/install.sh para Linux. Você clica duas vezes e ele pergunta se quer instalação automática ou manual. Escolha automática. Além do programa, ele instala sozinho os aceleradores certos pra sua configuração. Depois, scripts\run.bat abre a interface.
Opção C: pelo Pinokio. O Pinokio é um instalador de ferramentas de IA com loja de aplicativos. Um aviso que vem do próprio README e que economiza dor de cabeça: use os scripts da comunidade chamados wan2gp ou wan2gp-amd, do Morpheus, e não a instalação oficial do Pinokio.
5. O caminho manual, pra quem prefere
Se você já mexe com terminal, é isto, direto da documentação oficial. Para placas RTX 20XX até 50XX, com CUDA 13.1 instalado:
git clone https://github.com/deepbeepmeep/Wan2GP.git cd Wan2GP conda create -n wan2gp python=3.11.14 conda activate wan2gp pip install torch==2.10.0 torchvision==0.25.0 torchaudio==2.10.0 --index-url https://download.pytorch.org/whl/cu130 pip install -r requirements.txt
Para placas GTX 10XX, muda a versão de tudo, e o CUDA é o 12.8:
git clone https://github.com/deepbeepmeep/Wan2GP.git cd Wan2GP conda create -n wan2gp python=3.10.9 conda activate wan2gp pip install torch==2.7.1 torchvision==0.22.1 torchaudio==2.7.1 --index-url https://download.pytorch.org/whl/test/cu128 pip install -r requirements.txt
Duas armadilhas que a documentação avisa e que valem repetir: não use o PyTorch 2.8.0, que vaza memória ao trocar de modelo, nem o 2.9.0, que faz o consumo de VRAM explodir. E para placa AMD o guia é outro arquivo, o docs/AMD-INSTALLATION.md.
Depois de instalado, o resto está em docs/GETTING_STARTED.md no próprio repositório.
6. Se você não tem placa, o que sobra
Vale mais dizer isso do que fingir que todo mundo vai conseguir.
- A API paga da própria MiniMax. É onde os 2K funcionam hoje, e é o caminho de quem quer resultado sem montar nada.
- Alugar máquina com GPU por hora. Existem serviços que cobram por hora de uso e já vêm com o ambiente pronto. Sai mais barato que comprar placa se você vai usar uma vez.
- Aceitar que este não é o seu momento. Modelo aberto de vídeo melhora rápido e fica mais leve a cada versão. O que hoje pede 6 GB pedia muito mais um ano atrás.
7. O que eu conferi, e o que eu não testei
Tudo conferido em 23/08/2026, na fonte, não em vídeo de terceiro:
- O anúncio oficial da MiniMax (
minimax.io/news/minimax-h3-open-source): as specs de 15 segundos, 24 fps, 32 kHz estéreo, 2K, o padrão de 768 pixels no lado menor e os 11 idiomas saíram todos de lá. A frase sobre o módulo de 2K não ser aberto também - O README do WanGP (
github.com/deepbeepmeep/Wan2GP): o MiniMax H3 está na lista de modelos suportados, e o "a partir de 6 GB de VRAM" é literal de lá. As linhas de placa suportada, o detalhe do RTX série 30 e os três instaladores também - O guia de instalação oficial (
docs/INSTALLATION.md): os dois blocos de comando acima são cópia do que está lá, incluindo os avisos sobre as versões do PyTorch
O que eu não fiz, e não vou fingir: eu não instalei. Não tenho placa que rode isso, e instalar em máquina emprestada pra escrever um guia não é honesto. Os comandos acima são a documentação oficial, conferida hoje, e não a minha experiência de tela. Se travar em algum ponto, o lugar certo de perguntar é a página de issues do projeto, onde quem mantém responde.
E o aviso que vale pra qualquer guia de instalação: projeto aberto muda rápido. As versões exatas de Python e PyTorch acima são as de hoje. Se você está lendo isto semanas depois, abra o docs/INSTALLATION.md do repositório e compare antes de rodar. Use este guia pra saber o que procurar em cada etapa, não como receita eterna.