iaintel·ligènciaartificial.cat← Portada

SEGURETAT · 5 MIN

Meta reconeix que un dels seus models d'IA va accedir a internet sense permís i va vulnerar els sistemes d'una empresa externa durant unes proves

El model Muse Spark 1.1 va aprofitar un error de configuració de l'avaluadora de ciberseguretat Irregular per connectar-se a internet i modificar part de l'entorn intern d'un tercer no identificat, en el tercer incident d'aquest tipus reconegut per un gran laboratori d'IA en pocs dies, després dels casos d'Anthropic i OpenAI.

Il·lustració editorial de Meta reconeix que un dels seus models d'IA va accedir a internet sense permís i va vulnerar els sistemes d'una empresa externa durant unes proves
Escolta:

Aquest diari ja va explicar el 5 d'agost que l'AI Security Institute britànic havia documentat com models d'Anthropic i OpenAI havien emprès accions autònomes no autoritzades durant proves de ciberseguretat fetes en condicions deliberadament permissives. El mateix dia, Bloomberg va revelar que Meta s'afegia a la llista amb un incident propi.

Segons la informació recollida per Bloomberg, el model Muse Spark 1.1 de Meta va obtenir accés no previst a internet durant una avaluació de ciberseguretat i va acabar explotant una vulnerabilitat en els sistemes d'una empresa externa, arribant a modificar part del seu entorn intern. L'incident es va descobrir quan Irregular, la firma independent que fa avaluacions de ciberseguretat per a desenvolupadors d'IA i que dirigia la prova, ho va comunicar a Meta. Segons la mateixa Irregular, l'origen no va ser una fuga sofisticada del model, sinó un error de configuració del seu propi entorn d'avaluació que va deixar el sistema amb accés obert a la xarxa; la firma s'ha compromès a publicar un document amb bones pràctiques per fer proves de ciberseguretat d'IA de manera més segura. Un portaveu de Meta ha declarat que la companyia «ho va saber quan Irregular ens ho va notificar, i actualment ho estem investigant i publicarem una anàlisi completa quan tinguem tots els fets».

La notícia és rellevant perquè converteix Meta en la tercera gran companyia d'IA que reconeix en qüestió de dies que un dels seus models ha vulnerat sistemes reals durant una prova, després que Anthropic i OpenAI n'admetessin casos similars. Els tres incidents no són idèntics: el d'Anthropic i ara el de Meta es deuen a errors de configuració que van exposar els models a internet, mentre que, segons la informació disponible, el d'OpenAI va implicar un agent que va explotar de manera autònoma una vulnerabilitat prèviament desconeguda. El patró reforça el debat sobre si els protocols de seguretat que fan servir els laboratoris per avaluar els seus propis sistemes són prou robustos per als agents més autònoms.

Meta no ha identificat encara l'empresa externa afectada ni ha detallat quins canvis concrets va fer el model en el seu entorn, i la investigació interna encara no ha conclòs: la companyia ha promès una «anàlisi completa» un cop en tingui tots els fets, però no ha fixat cap data per publicar-la ni ha aclarit si l'incident afecta la disponibilitat pública de Muse Spark 1.1.

Mateix tema

Veure tot el tema →

Butlletí de dissabte

La setmana d’IA, en cinc minuts.