A desenvolvedora chinesa de IA MiniMax lançou na sexta-feira um modelo de geração de vídeo chamado H3, e suas ações listadas em Hong Kong subiram 17,4% para HK$230,0 nas primeiras negociações. O modelo cria clipes de até 15 segundos em resolução 2K com som produzido junto com a imagem, e também pode editar imagens existentes e copiar movimento entre clipes quando recebe material de referência em outros formatos.

A dimensão do movimento das ações diz tanto sobre o papel quanto sobre o modelo. A MiniMax abriu capital em Hong Kong em janeiro a HK$165, dobrou no primeiro dia e atingiu HK$1.330 em março. Depois caiu. O vencimento do lockup em 9 de julho liberou cerca de 49% de suas ações para negociação de uma só vez, o JPMorgan cortou seu preço-alvo duas vezes em uma semana, e as ações fecharam a HK$193,1 em 20 de julho. Mesmo após a alta de sexta-feira, elas ainda estão mais de 80% abaixo do pico de março.

Assim, o H3 é a primeira evidência em meses de que a MiniMax pode mover suas próprias ações com um produto, e não com a oferta de ações. Ele entra em um mercado liderado por outros. Na Artificial Analysis, que classifica modelos de vídeo por votos cegos de espectadores em comparações lado a lado, o Seedance 2.0 da ByteDance lidera texto para vídeo com áudio com 1.214 Elo, à frente do Kling 3.0 da Kuaishou e do Veo 3.1 do Google.

Um modelo em vez de uma dúzia de especialistas

Até agora, gerar vídeo com IA significava escolher um especialista. Um modelo transforma texto em vídeo. Outro anima uma imagem estática. Outro ainda troca um personagem em uma cena finalizada. Voz, efeitos sonoros e música vêm cada um de seus próprios sistemas. Construir um anúncio de 15 segundos significa mover arquivos entre quatro ou cinco ferramentas e torcer para que o rosto do personagem sobreviva ao processo.

A MiniMax diz que o H3 elimina isso. A empresa escreve que "o primeiro princípio que guiou o desenvolvimento do H3 foi unificar e generalizar entre tarefas", ou seja, um modelo que recebe qualquer combinação de imagens, clipes e áudio como referência e deduz a partir de uma frase em linguagem natural o que fazer com eles. Seu próprio exemplo pede ao modelo que tome emprestado um movimento de câmera de um vídeo, aplique-o a um rosto de uma imagem e cante com uma voz de um arquivo de áudio.

Para leitores de fora da área, a afirmação a avaliar não é a qualidade da imagem. É se a quantidade de ferramentas em uma linha de produção cai de cinco para uma, que é o que a MiniMax está vendendo para anunciantes e varejistas online em vez de para cineastas.

A alegação de preço e a promessa de pesos abertos

A MiniMax diz que o vídeo 2K do H3 custa menos de um terço do que os rivais convencionais cobram por segundo, e que sua saída em 768p custa menos da metade do que concorrentes cobram por 720p. Esses são números da empresa, não testes independentes.

O compromisso maior é a distribuição. A MiniMax diz que publicará os pesos do H3 em poucos dias, sujeita à lei e à regulação. Pesos são os números treinados que fazem um modelo funcionar, então publicá-los permite que qualquer pessoa baixe o H3 e o execute em seu próprio hardware sem pagar por acesso. O vídeo permaneceu majoritariamente fechado enquanto laboratórios chineses abriram seus modelos de texto. A MiniMax também diz que o H3 foi construído para rodar em vários chips fabricados na China.

Isso se encaixa em um padrão que vem remodelando o mercado mais amplo. A DeepSeek sustenta a ponta inferior em preço, a família Qwen da Alibaba tem a maior adesão entre desenvolvedores, a Moonshot lançou o Kimi K3 de 2,8 trilhões de parâmetros em 17 de julho, com os pesos a caminho, e a MiniMax já publica seu modelo de linguagem M3. O efeito sobre os laboratórios americanos aparece em dados de roteamento, não em benchmarks. A participação dos tokens enviados por empresas dos EUA por meio do marketplace OpenRouter de modelos chineses atingiu um pico de 46% em meados de 2026, contra uma média de 11% no ano anterior, e modelos chineses abertos operam de 60% a 90% mais baratos do que os principais sistemas da OpenAI e da Anthropic. Volume não é receita, e modelos fechados dos EUA ainda ganham muito mais por token em trabalhos premium. Mas o piso de preço está sendo definido na China, e o H3 estende isso de texto para vídeo.

O que não foi publicado

O tamanho do H3 não é público. Sem uma contagem de parâmetros, ninguém fora da empresa pode dizer se um H3 baixado roda em uma workstation ou precisa de um rack de aceleradores, o que determina se a promessa de pesos abertos significa muito na prática. Preços, limites de taxa e termos de licença para saída comercial também não foram publicados.

Também não há um número independente de qualidade. O H3 não tinha entrada nos rankings de vídeo da Artificial Analysis na sexta-feira, então as únicas comparações lado a lado disponíveis são os próprios clipes de demonstração da MiniMax, escolhidos pela MiniMax. Testadores iniciais sugerem que sua vantagem está no custo e no áudio, e não em trabalho de câmera com muito movimento, área em que os rivais ainda lideram.

A MiniMax prometeu um relatório técnico completo e diz que planeja incorporar seus modelos de linguagem em seguida. Investidores que compraram o movimento de sexta-feira estão apostando que os pesos chegarão no prazo e que um modelo mais barato e mais geral ganhará volume. A empresa tem alguns dias para provar isso.