La desarrolladora china de IA MiniMax lanzó el viernes un modelo de generación de video llamado H3, y sus acciones cotizadas en Hong Kong subieron 17.4% hasta HK$230.0 en las primeras operaciones. El modelo crea clips de hasta 15 segundos en resolución 2K con sonido producido junto con la imagen, y también puede editar metraje existente y copiar movimiento entre clips cuando se le proporciona material de referencia en otros formatos.
La magnitud del movimiento de la acción dice tanto sobre el valor como sobre el modelo. MiniMax cotizó en Hong Kong en enero a HK$165, se duplicó el primer día y tocó HK$1,330 en marzo. Luego cayó. El vencimiento del bloqueo del 9 de julio liberó alrededor de 49% de sus acciones para cotizar de una vez, JPMorgan recortó su precio objetivo dos veces en una semana, y las acciones cerraron en HK$193.1 el 20 de julio. Incluso después del salto del viernes, siguen más de 80% por debajo del máximo de marzo.
Así que H3 es la primera evidencia en meses de que MiniMax puede mover su propia acción con un producto en lugar de con la oferta de acciones. Entra en un mercado que otros lideran. En Artificial Analysis, que clasifica los modelos de video por votaciones ciegas lado a lado de espectadores, Seedance 2.0 de ByteDance encabeza el texto a video con audio con 1,214 Elo, por delante de Kling 3.0 de Kuaishou y Veo 3.1 de Google.
Un modelo en lugar de una docena de especialistas
Hasta ahora, generar video con IA ha significado elegir a un especialista. Un modelo convierte texto en video. Otro distinto anima una imagen fija. Otro sustituye un personaje en una toma terminada. La voz, los efectos de sonido y la música provienen cada uno de sus propios sistemas. Construir un anuncio de 15 segundos significa mover archivos entre cuatro o cinco herramientas y esperar que la cara del personaje sobreviva al proceso.
MiniMax dice que H3 elimina eso. La empresa escribe que "el primer principio que guio el desarrollo de H3 fue unificar y generalizar entre tareas", lo que significa un modelo que toma cualquier combinación de imágenes, clips y audio como referencia y deduce a partir de una frase en lenguaje natural qué hacer con ellos. Su propio ejemplo le pide al modelo tomar prestado un movimiento de cámara de un video, aplicarlo a un rostro de una imagen y cantar con una voz de un archivo de audio.
Para los lectores fuera del sector, la afirmación que hay que juzgar no es la calidad de imagen. Es si el número de herramientas en una cadena de producción baja de cinco a una, que es lo que MiniMax está vendiendo a anunciantes y minoristas en línea más que a cineastas.
La afirmación sobre el precio y la promesa de pesos abiertos
MiniMax dice que el video 2K de H3 cuesta menos de un tercio de lo que cobran los rivales convencionales por segundo, y que su salida de 768p cuesta menos de la mitad de lo que cobran los competidores por 720p. Esas son cifras de la empresa, no pruebas independientes.
El compromiso mayor es la distribución. MiniMax dice que publicará los pesos de H3 en cuestión de días, sujeto a la ley y la regulación. Los pesos son los números entrenados que hacen funcionar a un modelo, así que publicarlos permite a cualquiera descargar H3 y ejecutarlo en su propio hardware sin pagar por el acceso. El video ha permanecido mayormente cerrado mientras los laboratorios chinos abrían sus modelos de texto. MiniMax también dice que H3 fue construido para funcionar en varios chips fabricados en China.
Eso encaja con un patrón que ha estado reconfigurando el mercado más amplio. DeepSeek fija el extremo inferior en precio, la familia Qwen de Alibaba tiene el seguimiento de desarrolladores más amplio, Moonshot lanzó el Kimi K3 de 2.8 billones de parámetros el 17 de julio con los pesos por venir, y MiniMax ya publica su modelo de lenguaje M3. El efecto en los laboratorios estadounidenses aparece en los datos de enrutamiento más que en los benchmarks. La cuota de tokens enviados por firmas de EE.UU. a través del mercado OpenRouter alcanzó un pico de 46% a mediados de 2026, frente a un promedio de 11% durante el año anterior, y los modelos chinos abiertos funcionan entre 60% y 90% más baratos que los sistemas líderes de OpenAI y Anthropic. El volumen no es ingreso, y los modelos cerrados de EE.UU. siguen ganando mucho más por token en trabajos premium. Pero el piso de precios se está fijando en China, y H3 extiende eso del texto al video.
Lo que no se ha publicado
El tamaño de H3 no es público. Sin un recuento de parámetros, nadie fuera de la empresa puede decir si un H3 descargado funciona en una estación de trabajo o necesita un rack de aceleradores, lo que determina si la promesa de pesos abiertos significa mucho en la práctica. Los precios, los límites de uso y las condiciones de licencia para resultados comerciales tampoco se han publicado.
Tampoco hay una cifra independiente de calidad. H3 no tenía entrada en las clasificaciones de video de Artificial Analysis el viernes, así que las únicas comparaciones lado a lado disponibles son los propios clips de demostración de MiniMax, elegidos por MiniMax. Los primeros evaluadores sugieren que su ventaja está en el costo y el audio más que en el trabajo de cámara con mucho movimiento, donde los rivales todavía lideran.
MiniMax ha prometido un informe técnico completo y dice que planea incorporar después sus modelos de lenguaje. Los inversores que compraron el movimiento del viernes están apostando a que los pesos lleguen según lo previsto y a que un modelo más barato y más general gane volumen. La empresa tiene unos pocos días para demostrarlo.
