iaintel·ligènciaartificial.cat← Portada

TECNOLOGIA · 4 MIN

Una startup xinesa allibera en codi obert un model de 309.000 milions de paràmetres desenvolupat amb l'ajuda d'IA

NaiveAI publica Naive-N0.5-Flash amb llicència MIT, un model que prescindeix per complet de les capes d'atenció completa i assoleix una finestra de context d'un milió de testimonis, i que l'empresa diu haver desenvolupat amb sistemes d'IA que han fet bona part de la feina de recerca i enginyeria.

Il·lustració generada amb IA: Una startup xinesa allibera en codi obert un model de 309.000 milions de paràmetres desenvolupat amb l'ajuda d'IA
Il·lustració generada amb IA
Escolta:

La competència entre laboratoris xinesos i nord-americans per publicar models d'IA oberts s'ha intensificat aquest 2026, amb llançaments gairebé setmanals d'Alibaba, DeepSeek o Z.ai que aposten per fer-se un lloc davant els models tancats d'OpenAI, Google i Anthropic. NaiveAI, una startup de Pequín, hi afegeix ara un model propi amb una arquitectura poc habitual.

El 27 de setembre, NaiveAI va publicar a Hugging Face, amb llicència oberta MIT, el model Naive-N0.5-Flash: 309.000 milions de paràmetres en total, dels quals només 15.500 milions s'activen a cada consulta (una arquitectura de barreja d'experts), i una finestra de context d'un milió de testimonis aconseguida sense cap capa d'atenció completa, combinant atenció de finestra lliscant amb una versió lleugera de l'atenció dispersa que fa servir DeepSeek. El model arriba a 50 testimonis per segon en mode estàndard i fins a 2.000 en un mode més ràpid, gràcies a tècniques d'optimització d'inferència. NaiveAI explica que bona part de la recerca i l'enginyeria del projecte s'ha fet amb sistemes d'IA que escrivien codi, executaven experiments i n'analitzaven els resultats.

Que un model d'aquesta mida prescindeixi de les capes d'atenció completa i mantingui igualment una finestra de context d'un milió de testimonis és un indicador tècnic que interessa a qui dissenya models grans, perquè aquestes capes solen ser el coll d'ampolla de cost i memòria quan el context creix. Que una startup relativament petita el publiqui en obert, amb llicència MIT, l'afegeix a la pressió a la baixa sobre el preu i l'accés als models de referència.

Les xifres de velocitat i de rendiment provenen de la mateixa NaiveAI, sense una avaluació independent publicada encara, i l'afirmació que el desenvolupament s'ha fet «amb IA» és una descripció de l'empresa que no es pot verificar amb detall extern. Caldrà veure com es comporta el model en bancs de proves independents abans de saber si compleix les xifres que en dona el seu creador.

Mateix tema

Veure tot el tema →

Butlletí de dissabte

La setmana d’IA, en cinc minuts.