La cursa pels models de vídeo generatiu s'ha convertit en un dels terrenys on els grans grups tecnològics xinesos —Alibaba, ByteDance, ara també ampliats amb l'esforç de ràpid creixement de Qwen— mesuren els seus avenços davant de rivals com Google o OpenAI. Wan, la família de models de vídeo d'Alibaba, n'és una de les apostes centrals, i la companyia n'havia obert una versió beta pública el 6 d'agost.
Alibaba ha llançat aquest dilluns la versió definitiva de Wan3.0, capaç de generar vídeos de fins a 30 segons a partir de documents, fulls de càlcul, presentacions o pàgines web, no només d'imatges o text descriptiu. Segons la companyia, el model ja s'ha fet servir des de la fase de proves en produccions de sèries curtes i cinema, publicitat, promoció turística i creació de videoclips musicals. El llançament arriba justament l'endemà que Alibaba tanqués una ampliació de capital de 10.000 milions de dòlars —la col·locació primària més grossa feta mai per una empresa cotitzada a Hong Kong—, uns diners que l'empresa ha confirmat que destinarà íntegrament al que anomena les seves «capacitats d'IA de pila completa»: xips, infraestructura i desenvolupament i desplegament de models.
Que Alibaba faci aquest moviment és rellevant perquè arriba just després que la companyia reconegués una caiguda del 75% en el benefici trimestral respecte de fa un any, atribuïda a la despesa creixent en infraestructura d'IA: en comptes de frenar, l'empresa opta per doblar l'aposta, en la mateixa línia expansiva que ja mostraven els mil milions de descàrregues acumulades pels seus models oberts Qwen.
Les xifres d'adopció de Wan3.0 en producció provenen únicament de la mateixa Alibaba, sense cap verificació independent, i la companyia no ha detallat com es repartirà exactament el capital captat entre xips, infraestructura i desenvolupament de models, ni quan n'espera veure el retorn.