iaintel·ligènciaartificial.cat← Portada

CIBERSEGURETAT · 4 MIN

Anthropic adverteix que GLM-5.3, un model obert xinès sense salvaguardes, ja construeix exploits gairebé tan bé com el seu Mythos Preview

El model de Zhipu AI va generar atacs complets en 50 de 410 intents en una prova sobre el motor V8 de Chrome. Les proteccions contra l'ús maliciós es poden esquivar fins al 100% dels casos si es modifiquen els pesos.

Il·lustració generada amb IA: Anthropic adverteix que GLM-5.3, un model obert xinès sense salvaguardes, ja construeix exploits gairebé tan bé com el seu Mythos Preview
Il·lustració generada amb IA
Escolta:

Fins ara, les capacitats ofensives més avançades en ciberseguretat havien quedat en mans de models tancats, com Claude Mythos Preview d'Anthropic, que s'ofereixen amb restriccions. L'equip de seguretat d'Anthropic ha avaluat ara GLM-5.3, el darrer model de la xinesa Zhipu AI (Z.ai), que es pot descarregar i s'ha publicat sense proteccions efectives contra l'abús.

Segons l'informe, publicat el 29 de setembre, GLM-5.3 va construir exploits complets en 50 de 410 intents (un 12%) a ExploitBench, una prova sobre vulnerabilitats del motor V8 de Chrome; Mythos Preview n'aconsegueix un 14%. En una altra prova interna, el 4% dels intents van segrestar el flux d'execució d'un programa, mentre que els models anteriors, com Claude Opus 4.6 o GLM-5.2, no hi arribaven pràcticament mai. En una sessió d'un dia, amb poca supervisió humana, el model va descobrir diverses vulnerabilitats desconegudes del motor de JavaScript i les va encadenar en una pàgina web capaç de robar claus SSH privades.

Anthropic assenyala també que les proteccions de GLM-5.3 es poden esquivar: un 64% de col·laboració amb una història fictícia que serveix de coartada, un 92% si s'omple per endavant el raonament del model i un 100% si es retoquen els pesos. Els models de Claude provats no van col·laborar en cap cas. El Centre per als Estàndards i la Innovació en IA del NIST (CAISI) el considera el model obert amb més capacitat cibernètica fins ara, amb uns quatre mesos de retard respecte de la frontera nord-americana. Anthropic reclama proves independents dels governs, accés dels defensors a models de frontera i salvaguardes per a tots els desenvolupadors.

Convé llegir-ho amb cautela: l'avaluació l'ha feta una empresa que competeix amb Zhipu AI i que ven models amb restriccions, i les proves de seguretat de GLM-5.3 es limiten a les que Anthropic descriu. Les xifres mesuren què pot fer el model en entorns controlats, no quants atacs reals s'han fet amb ell.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.