Els controls d'exportació nord-americans limiten des de fa temps la venda a la Xina dels xips d'IA més avançats de Nvidia, una restricció que ha alimentat el dubte de si les empreses xineses poden desenvolupar i fer servir en producció models d'intel·ligència artificial de qualitat comparable a la dels laboratoris occidentals sense accés a aquest maquinari. L'empresa xinesa Z.ai (Zhipu) ha ofert aquesta setmana una resposta pràctica a aquest dubte.
Z.ai ha confirmat que una versió de prova pública del seu model GLM-5.3-Flash ha funcionat durant una setmana sencerament sobre acceleradors fabricats a la Xina, sense cap maquinari de Nvidia a la infraestructura, fent servir més de 100.000 xips domèstics per al servei d'inferència. Segons l'empresa, el cost per token resultant és comparable al d'un sistema equivalent sobre GPU de Nvidia; a la seva API, el model té un preu de 0,15 dòlars per milió de tokens d'entrada i 0,50 dòlars per milió de sortida, poc més d'un 10% del preu del seu germà gran, GLM-5.3. Z.ai, però, no ha revelat quin fabricant hi ha darrere d'aquests xips ni ha publicat xifres de rendiment (throughput) o de consum energètic.
La notícia és rellevant perquè constitueix una evidència creïble que un model obert de qualitat de frontera es pot servir a escala de producció sobre acceleradors xinesos, cosa que qüestiona alguns dels supòsits sobre els quals es basa l'estratègia nord-americana de controls d'exportació de xips: si la indústria xinesa ja pot executar aquests models en producció sense Nvidia, l'efecte real d'aquestes restriccions sobre el desplegament d'IA a la Xina queda en dubte.
La demostració, amb tot, té límits clars: no revela si l'entrenament del model —i no només la seva execució en producció— es va fer també sense maquinari de Nvidia, ni permet comparar-lo de manera controlada i independent amb un sistema concret de Nvidia sota les mateixes condicions. Es tracta, per ara, d'una afirmació de la mateixa empresa, sense verificació externa dels detalls tècnics.