Código abierto

MiniMax H3: medio mundo hace herramientas con él; España no

MiniMax publicó los pesos de su generador de vídeo H3 el 3 de agosto. Mes y medio después hay un ecosistema montado encima: control de cámara sobre vídeo ya grabado, un marco que reúne nueve tareas y una destilación catorce veces más rápida. Y una letra pequeña que decide si sirve aquí: la licencia excluye el despliegue local en la Unión Europea, el Reino Unido, Corea del Sur y Estados Unidos.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

MiniMax H3: medio mundo hace herramientas con él; España no
📷 Imagen generada con IA

En resumen

  • MiniMax —laboratorio chino de inteligencia artificial, autor de la aplicación de vídeo Hailuo— publicó los pesos abiertos de MiniMax-H3 el 3 de agosto de 2026: 33.000 millones de parámetros y clips de hasta 15 segundos con audio estéreo nativo. Los pesos publicados validan 768p: el módulo que sube a 2K no está liberado y solo se llega por la API de la empresa.
  • Viggle AI, empresa de herramientas creativas de vídeo con inteligencia artificial, ha publicado Meridian, un derivado que mueve la cámara sobre vídeo ya existente con órbitas, campo de visión ajustable, congelado de fotograma y cámara lenta.
  • FastH3, del Hao AI Lab de la Universidad de California en San Diego, destila H3 de 49 pasos de inferencia a 4 y es hasta 14,38 veces más rápido. Esa cifra es de su versión 1, del 27 de agosto; la V2 se anunció el 15 de septiembre sin cifras.
  • El MiniMax Community License Agreement excluye a Estados Unidos, la Unión Europea, el Reino Unido y Corea del Sur, y no solo del despliegue local: también del uso de lo que el modelo produce. Los pesos están publicados, pero la licencia no ampara a quien los monte en España.

MiniMax abrió los pesos de H3 y otros construyeron encima

MiniMax —laboratorio chino de inteligencia artificial, autor de la familia H3 y de la aplicación de vídeo Hailuo— publicó los pesos de MiniMax-H3 el 3 de agosto de 2026 en Hugging Face, la plataforma estadounidense de modelos abiertos. Es un modelo omnimodal de 33.000 millones de parámetros que genera clips de hasta 15 segundos a 24 fotogramas por segundo, con audio estéreo nativo. Los pesos que se descargan validan 768p; el módulo H3-Regenerate-2K, que sube la resolución, no está publicado y solo se usa por la API de la Open Platform de MiniMax.

Con él liberó dos puntos de control de H3-Base, que generan vídeo y audio estéreo nativo pero aceptan controles distintos. Uno es Ref2VA, reference-to-audio-video: imágenes, clips de vídeo y audio opcional guían partes distintas de un mismo clip de destino.

La noticia, sin embargo, no es aquel lanzamiento, sino lo que ha venido después sin mano de MiniMax: alrededor del 15 de septiembre confluyen tres piezas de terceros que usan H3 como cimiento y no como producto.

Leer más: GitHub — MiniMax-AI/MiniMax-H3 ↗

Meridian mueve la cámara sobre un vídeo ya grabado

Viggle AI, empresa de herramientas creativas de vídeo con inteligencia artificial, ha publicado Meridian en Hugging Face como Viggle/Meridian. Es un derivado de MiniMax-H3 que separa dos cosas que suelen ir pegadas: controla el movimiento de cámara con independencia de lo que ocurre en la escena, y lo hace sobre vídeo que ya existe.

Admite órbitas, campo de visión (FOV) ajustable, congelado de fotograma —el efecto bullet time—, cámara lenta y puntos de vista nuevos a partir de una sola imagen. Entrega clips de unos 3 a 10 segundos a 24 fotogramas por segundo, reutilizando el transformador y el VAE de H3.

La licencia va partida: el código es Apache 2.0 y los pesos, MiniMax H3 Community License Agreement, con la misma exclusión geográfica. El modelo de geometría VGGT-Omega que emplea exige además licencia aparte de Meta —dueña de Facebook, Instagram y WhatsApp—, solo para investigación.

Leer más: Hugging Face — Viggle/Meridian ↗

LynnReal-Omni mete nueve tareas de vídeo en un mismo marco

Qué añade cada herramienta sobre MiniMax H3
Herramienta Quién la hace Qué añade Fecha
Meridian Viggle AI Control de cámara, FOV, bullet time y cámara lenta sobre vídeo existente septiembre de 2026
LynnReal-Omni LynnReal-AI Nueve tareas de vídeo en un solo marco, en cuatro pasos septiembre de 2026
FastH3 FastVideo (Hao AI Lab, UC San Diego) Destilación a cuatro pasos: hasta 14 veces más rápido 27 de agosto de 2026 (v1); V2 anunciada el 15 de septiembre
Ref2VA MiniMax Punto de control de H3-Base: imágenes, clips y audio guían partes distintas del mismo clip 3 de agosto de 2026
Cifras y capacidades comunicadas por cada equipo. Los pesos de H3 y de sus derivados van bajo una licencia que excluye el despliegue local en la Unión Europea, el Reino Unido, Corea del Sur y Estados Unidos.

LynnReal-AI ha publicado LynnReal-Omni, un marco construido sobre un transformador de difusión multimodal compartido de 32.000 millones de parámetros que sigue la arquitectura de MiniMax H3. Reúne en uno solo texto a vídeo, imagen a vídeo, generación guiada por pose, control estructural, omni-referencia, transferencia de estilo, edición, restauración y vídeo largo en streaming, todo en cuatro pasos. Conviene leerlo como un anuncio y no como una herramienta terminada: el propio repositorio avisa de que los pesos se irán subiendo y de que el puerto a ComfyUI es experimental y está en obras.

Su directorio comfyui/ trae flujos de trabajo para t2v, i2v, r2v, pose2v y v2v, con los nodos que necesitan y los pesos que cargan. ComfyUI —entorno gráfico de flujos de trabajo para modelos generativos, muy extendido en la comunidad de código abierto— tiene además nodos nativos para MiniMax H3, ajenos a este paquete.

Leer más: GitHub — LynnReal-AI/LynnReal-Omni ↗

FastH3 baja de cuarenta y nueve pasos a cuatro

Tiempo de generación de FastH3 v1 en una sola GPU B200
Clip de 5 s: 16,2s Clip de 5 s 16,2s Clip de 10 s: 31,1s Clip de 10 s 31,1s Clip de 15 s: 47,2s Clip de 15 s 47,2s
Ver los datos en tabla
Clip de 5 sClip de 10 sClip de 15 s
Segundos 16,2s31,1s47,2s
Medición comunicada por FastVideo sobre B200, a 1344×768 y 24 fotogramas por segundo con audio. Corresponde a la versión 1, no a la V2 anunciada el 15 de septiembre.

FastH3 es un proyecto de FastVideo, del Hao AI Lab —grupo de investigación de la Universidad de California en San Diego—, con Nuva Lab y el equipo FastGen de NVIDIA, fabricante de los aceleradores Blackwell y B200. Combina DMD2, que baja de 49 pasos de inferencia a 4, con VSA, que poda el 90 % del cómputo de cada paso.

Los cuatro pasos son el ajuste de mínima latencia, no el recomendado a secas: sus autores apuntan que ocho pueden dar mejor calidad. Las cifras publicadas son de FastH3 v1, del 27 de agosto de 2026: sobre una B200, a 1344×768 y 24 fotogramas por segundo con audio, un clip de 15 segundos sale en 47,2 segundos, 14,38 veces más rápido que el modelo base denso.

El 15 de septiembre de 2026 se anunció en el foro r/StableDiffusion FastH3 V2, también con pesos abiertos. De esa segunda versión no hay más que el anuncio: ni cifras ni entrada de blog, así que las de arriba son de la primera y no se le pueden atribuir.

Leer más: Hao AI Lab — FastH3: destilación en cuatro pasos de MiniMax H3 ↗

La licencia deja fuera el despliegue local en la Unión Europea

Aquí está el dato que decide si algo de esto sirve a un lector español: el MiniMax Community License Agreement excluye expresamente a Estados Unidos, la Unión Europea, el Reino Unido y Corea del Sur, y no solo del despliegue local: su cláusula IV.4 prohíbe usar, reproducir, modificar, distribuir o mostrar el modelo «o cualquiera de sus salidas o resultados» fuera del territorio autorizado. Los pesos se descargan como cualquier otro, pero la licencia no ampara a quien los monte en España ni, leída al pie de la letra, a quien publique lo que salga de ellos. La propia licencia deja una puerta: invita a los interesados de esos territorios a solicitar una licencia específica.

Y aquí aparece la contradicción que el propio ecosistema pone encima de la mesa. Estados Unidos está en esa lista de territorios excluidos, y sin embargo la destilación más citada de todas las que se han montado sobre H3, FastH3, sale del Hao AI Lab de la Universidad de California en San Diego y la firma junto al equipo FastGen de NVIDIA, una empresa estadounidense. Es decir: el laboratorio que más ha empujado este modelo trabaja desde un territorio tan excluido como España. De Viggle AI y LynnReal-AI no consta públicamente dónde tienen su sede, así que de ellas no se puede decir lo mismo ni lo contrario. Queda la pregunta, que ni MiniMax ni los proyectos han respondido: si la cláusula se lee al pie de la letra, buena parte de lo que se está construyendo encima nace ya fuera del territorio autorizado.

Y la exclusión viaja con el modelo: los pesos de Meridian llevan la misma cláusula, aunque su código sea Apache 2.0. Al listón jurídico se suma el de la máquina: Meridian pide entre 88 y 113 GiB de memoria de GPU sobre una sola B200, el mismo acelerador de las mediciones de FastH3.

Conclusión

El valor de un modelo abierto no se mide el día que se publica, sino por lo que otros levantan encima: en mes y medio, MiniMax-H3 ha pasado de generador de vídeo a cimiento de una herramienta de cámara, de un marco de nueve tareas y de una destilación catorce veces más rápida. Falta ver qué trae FastH3 V2, anunciada sin cifras. Y para el lector español la pregunta no es técnica sino jurídica: la puerta no la abre la GPU, la abre el contrato.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog