iaintel·ligènciaartificial.cat← Portada

XIPS · 4 MIN

Huawei allibera en obert openPangu-2.0-Pro, un model de 505.000 milions de paràmetres entrenat sense xips de Nvidia

La companyia xinesa publica els pesos, el codi d'inferència i l'informe tècnic d'un model amb 18.000 milions de paràmetres actius per token i una finestra de context de 512.000 tokens, entrenat íntegrament amb els seus propis processadors Ascend, en la seva aposta més ambiciosa per demostrar que pot competir en IA de frontera sense maquinari nord-americà.

Il·lustració editorial de Huawei allibera en obert openPangu-2.0-Pro, un model de 505.000 milions de paràmetres entrenat sense xips de Nvidia
Escolta:

La guerra comercial pels xips d'intel·ligència artificial ha empès Huawei a desenvolupar tota la seva pila tecnològica pròpia -processadors, programari i models- per no dependre del maquinari nord-americà que Washington li té vetat des de fa anys.

Huawei va publicar aquest 31 de juliol openPangu-2.0-Pro, un model de llenguatge de codi obert amb aproximadament 505.000 milions de paràmetres totals, dels quals uns 18.000 milions s'activen per cada token processat, amb una finestra de context de 512.000 tokens. La companyia n'ha alliberat els pesos, el codi bàsic d'inferència i un informe tècnic, i explica que l'ha entrenat íntegrament amb els seus propis processadors neuronals Ascend, amb un conjunt de dades d'entrenament d'aproximadament 34 bilions de tokens i tècniques d'ajust supervisat, aprenentatge per reforç especialitzat i destil·lació en línia per millorar-ne el rendiment.

La notícia és rellevant perquè demostra que els laboratoris xinesos continuen avançant en models oberts de gran escala sense dependre de maquinari de Nvidia, en la línia d'altres llançaments recents com Kimi K3 de Moonshot AI, una tendència que pressiona els laboratoris occidentals i alimenta el debat sobre destil·lació i control d'exportacions que ja ha protagonitzat altres episodis aquest mes de juliol.

Huawei no ha publicat comparatives independents de rendiment enfront de models rivals occidentals com GPT-5.6 o Claude, no s'ha confirmat quin cost real de còmput ha suposat l'entrenament amb Ascend, i encara no se sap amb quina rapidesa la comunitat de desenvolupadors adoptarà un model d'aquesta envergadura.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.