Codi obert

MiniMax H3: mig món hi fa eines; Espanya no

MiniMax va publicar els pesos del seu generador de vídeo H3 el 3 d'agost. Un mes i mig després hi ha un ecosistema muntat a sobre: control de càmera sobre vídeo ja gravat, un marc que aplega nou tasques i una destil·lació catorze vegades més ràpida. I una lletra petita que decideix si serveix aquí: la llicència exclou el desplegament local a la Unió Europea, el Regne Unit, Corea del Sud i els Estats Units.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

MiniMax H3: medio mundo hace herramientas con él; España no
📷 Imatge generada amb IA

En resum

  • MiniMax —laboratori xinès d'intel·ligència artificial, autor de l'aplicació de vídeo Hailuo— va publicar els pesos oberts de MiniMax-H3 el 3 d'agost de 2026: 33.000 milions de paràmetres i clips de fins a 15 segons amb àudio estèreo natiu. Els pesos publicats validen 768p: el mòdul que puja a 2K no està alliberat i només s'hi arriba per l'API de l'empresa.
  • Viggle AI, empresa d'eines creatives de vídeo amb intel·ligència artificial, ha publicat Meridian, un derivat que mou la càmera sobre vídeo ja existent amb òrbites, camp de visió ajustable, congelació de fotograma i càmera lenta.
  • FastH3, del Hao AI Lab de la Universitat de Califòrnia a San Diego, destil·la H3 de 49 passos d'inferència a 4 i és fins a 14,38 vegades més ràpid. Aquesta xifra és de la seva versió 1, del 27 d'agost; la V2 es va anunciar el 15 de setembre sense xifres.
  • El MiniMax Community License Agreement exclou els Estats Units, la Unió Europea, el Regne Unit i Corea del Sud, i no només del desplegament local: també de l'ús d'allò que el model produeix. Els pesos estan publicats, però la llicència no empara qui els munti a Espanya.

MiniMax va obrir els pesos d'H3 i uns altres hi van construir a sobre

MiniMax —laboratori xinès d'intel·ligència artificial, autor de la família H3 i de l'aplicació de vídeo Hailuo— va publicar els pesos de MiniMax-H3 el 3 d'agost de 2026 a Hugging Face, la plataforma nord-americana de models oberts. És un model omnimodal de 33.000 milions de paràmetres que genera clips de fins a 15 segons a 24 fotogrames per segon, amb àudio estèreo natiu. Els pesos que es descarreguen validen 768p; el mòdul H3-Regenerate-2K, que puja la resolució, no està publicat i només es fa servir per l'API de l'Open Platform de MiniMax.

Amb ell va alliberar dos punts de control d'H3-Base, que generen vídeo i àudio estèreo natiu però accepten controls diferents. Un és Ref2VA, reference-to-audio-video: imatges, clips de vídeo i àudio opcional guien parts diferents d'un mateix clip de destinació.

La notícia, però, no és aquell llançament, sinó el que ha vingut després sense mà de MiniMax: cap al 15 de setembre hi conflueixen tres peces de tercers que fan servir H3 com a fonament i no com a producte.

Llegir-ne més: GitHub — MiniMax-AI/MiniMax-H3 ↗

Meridian mou la càmera sobre un vídeo ja gravat

Viggle AI, empresa d'eines creatives de vídeo amb intel·ligència artificial, ha publicat Meridian a Hugging Face com a Viggle/Meridian. És un derivat de MiniMax-H3 que separa dues coses que solen anar enganxades: controla el moviment de càmera amb independència del que passa a l'escena, i ho fa sobre vídeo que ja existeix.

Admet òrbites, camp de visió (FOV) ajustable, congelació de fotograma —l'efecte bullet time—, càmera lenta i punts de vista nous a partir d'una sola imatge. Lliura clips d'uns 3 a 10 segons a 24 fotogrames per segon, reutilitzant el transformador i el VAE d'H3.

La llicència va partida: el codi és Apache 2.0 i els pesos, MiniMax H3 Community License Agreement, amb la mateixa exclusió geogràfica. El model de geometria VGGT-Omega que utilitza exigeix a més llicència a part de Meta —propietària de Facebook, Instagram i WhatsApp—, només per a recerca.

Llegir-ne més: Hugging Face — Viggle/Meridian ↗

LynnReal-Omni fica nou tasques de vídeo en un mateix marc

Què afegeix cada eina sobre MiniMax H3
Eina Qui la fa Què hi afegeix Data
Meridian Viggle AI Control de càmera, FOV, bullet time i càmera lenta sobre vídeo existent setembre de 2026
LynnReal-Omni LynnReal-AI Nou tasques de vídeo en un sol marc, en quatre passos setembre de 2026
FastH3 FastVideo (Hao AI Lab, UC San Diego) Destil·lació a quatre passos: fins a 14 vegades més ràpid 27 d'agost de 2026 (v1); V2 anunciada el 15 de setembre
Ref2VA MiniMax Punt de control d'H3-Base: imatges, clips i àudio guien parts diferents del mateix clip 3 d'agost de 2026
Xifres i capacitats comunicades per cada equip. Els pesos d'H3 i dels seus derivats van sota una llicència que exclou el desplegament local a la Unió Europea, el Regne Unit, Corea del Sud i els Estats Units.

LynnReal-AI ha publicat LynnReal-Omni, un marc construït sobre un transformador de difusió multimodal compartit de 32.000 milions de paràmetres que segueix l'arquitectura de MiniMax H3. Aplega en un de sol text a vídeo, imatge a vídeo, generació guiada per pose, control estructural, omni-referència, transferència d'estil, edició, restauració i vídeo llarg en streaming, tot en quatre passos. Convé llegir-ho com un anunci i no com una eina acabada: el mateix repositori avisa que els pesos s'aniran pujant i que el port a ComfyUI és experimental i està en obres.

El seu directori comfyui/ porta fluxos de treball per a t2v, i2v, r2v, pose2v i v2v, amb els nodes que necessiten i els pesos que carreguen. ComfyUI —entorn gràfic de fluxos de treball per a models generatius, molt estès a la comunitat de codi obert— té a més nodes natius per a MiniMax H3, aliens a aquest paquet.

Llegir-ne més: GitHub — LynnReal-AI/LynnReal-Omni ↗

FastH3 baixa de quaranta-nou passos a quatre

Temps de generació de FastH3 v1 en una sola GPU B200
Clip de 5 s: 16,2s Clip de 5 s 16,2s Clip de 10 s: 31,1s Clip de 10 s 31,1s Clip de 15 s: 47,2s Clip de 15 s 47,2s
Ver los datos en tabla
Clip de 5 sClip de 10 sClip de 15 s
Segons 16,2s31,1s47,2s
Mesura comunicada per FastVideo sobre B200, a 1344×768 i 24 fotogrames per segon amb àudio. Correspon a la versió 1, no a la V2 anunciada el 15 de setembre.

FastH3 és un projecte de FastVideo, del Hao AI Lab —grup de recerca de la Universitat de Califòrnia a San Diego—, amb Nuva Lab i l'equip FastGen d'NVIDIA, fabricant dels acceleradors Blackwell i B200. Combina DMD2, que baixa de 49 passos d'inferència a 4, amb VSA, que poda el 90 % del còmput de cada pas.

Els quatre passos són l'ajust de mínima latència, no el recomanat sense més: els seus autors apunten que vuit poden donar millor qualitat. Les xifres publicades són de FastH3 v1, del 27 d'agost de 2026: sobre una B200, a 1344×768 i 24 fotogrames per segon amb àudio, un clip de 15 segons surt en 47,2 segons, 14,38 vegades més ràpid que el model base dens.

El 15 de setembre de 2026 es va anunciar al fòrum r/StableDiffusion FastH3 V2, també amb pesos oberts. D'aquesta segona versió no hi ha res més que l'anunci: ni xifres ni entrada de blog, així que les de dalt són de la primera i no se li poden atribuir.

Llegir-ne més: Hao AI Lab — FastH3: destil·lació en quatre passos de MiniMax H3 ↗

La llicència deixa fora el desplegament local a la Unió Europea

Aquí hi ha la dada que decideix si res d'això serveix a un lector espanyol: el MiniMax Community License Agreement exclou expressament els Estats Units, la Unió Europea, el Regne Unit i Corea del Sud, i no només del desplegament local: la seva clàusula IV.4 prohibeix fer servir, reproduir, modificar, distribuir o mostrar el model «o qualsevol de les seves sortides o resultats» fora del territori autoritzat. Els pesos es descarreguen com qualsevol altre, però la llicència no empara qui els munti a Espanya ni, llegida al peu de la lletra, qui publiqui allò que en surti. La mateixa llicència deixa una porta: convida els interessats d'aquests territoris a sol·licitar una llicència específica.

I aquí apareix la contradicció que el mateix ecosistema posa damunt la taula. Els Estats Units són en aquesta llista de territoris exclosos i, tanmateix, la destil·lació més citada de totes les que s'han muntat sobre H3, FastH3, surt del Hao AI Lab de la Universitat de Califòrnia a San Diego i la signa juntament amb l'equip FastGen d'NVIDIA, una empresa nord-americana. És a dir: el laboratori que més ha empès aquest model treballa des d'un territori tan exclòs com Espanya. De Viggle AI i LynnReal-AI no consta públicament on tenen la seu, així que d'elles no se'n pot dir ni el mateix ni el contrari. Queda la pregunta, que ni MiniMax ni els projectes no han respost: si la clàusula es llegeix al peu de la lletra, bona part del que s'està construint a sobre neix ja fora del territori autoritzat.

I l'exclusió viatja amb el model: els pesos de Meridian porten la mateixa clàusula, encara que el seu codi sigui Apache 2.0. Al llistó jurídic s'hi suma el de la màquina: Meridian demana entre 88 i 113 GiB de memòria de GPU sobre una sola B200, el mateix accelerador de les mesures de FastH3.

Conclusió

El valor d'un model obert no es mesura el dia que es publica, sinó pel que uns altres hi aixequen a sobre: en un mes i mig, MiniMax-H3 ha passat de generador de vídeo a fonament d'una eina de càmera, d'un marc de nou tasques i d'una destil·lació catorze vegades més ràpida. Falta veure què porta FastH3 V2, anunciada sense xifres. I per al lector espanyol la pregunta no és tècnica sinó jurídica: la porta no l'obre la GPU, l'obre el contracte.

Fonts primàries

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog