MiniMax, l'empresa xinesa amb seu a Shanghai coneguda pel seu model de vídeo Hailuo, forma part de l'onada de laboratoris asiàtics —juntament amb ByteDance o Kuaishou— que competeixen per dominar la generació de vídeo amb intel·ligència artificial, un terreny on fins ara els models nord-americans com Sora d'OpenAI o Veo de Google havien marcat el ritme.
El 31 de juliol de 2026, MiniMax va presentar H3, un model multimodal que accepta text, imatges, vídeo i àudio com a entrada, i que genera clips de fins a 15 segons en resolució 2K amb so estèreo natiu —diàleg, ambient, passes i música— produït en la mateixa passada que la imatge, no afegit a posteriori. El model també permet editar vídeos existents i transferir el moviment d'un clip a un altre a partir d'instruccions o materials de referència. Segons la companyia, el preu per segon de vídeo a 2K és inferior a un terç del que cobren els models rivals més utilitzats, i a resolució 768p el cost és inferior a la meitat del que costen els 720p de la competència.
MiniMax ha anunciat que alliberarà els pesos del model en els pròxims dies, "subjecte a les lleis i regulacions aplicables", una decisió que s'emmarca en l'estratègia dels laboratoris xinesos de competir per quota de mercat oferint eines obertes i més barates que les nord-americanes, en sectors com la publicitat, l'e-commerce o el disseny de producte, on la generació ràpida de vídeo curt té un valor comercial immediat.
MiniMax no ha revelat els paràmetres tècnics complets del model ni els detalls del seu entrenament, i les comparatives de cost i qualitat provenen de les seves pròpies proves internes. Tampoc s'ha aclarit encara sota quina llicència exacta es publicaran els pesos ni quines restriccions d'ús, si n'hi ha, s'hi aplicaran.