iaintel·ligènciaartificial.cat← Portada

SEGURETAT · 5 MIN

Cap gran empresa d'IA passa d'un aprovat raspat en seguretat, segons el nou índex del Future of Life Institute

L'edició d'estiu de l'AI Safety Index avalua nou grans empreses d'intel·ligència artificial en 37 indicadors i cap supera la nota de C+: Anthropic lidera per davant d'OpenAI i Google DeepMind, mentre xAI, DeepSeek i Mistral suspenen.

Il·lustració editorial de Cap gran empresa d'IA passa d'un aprovat raspat en seguretat, segons el nou índex del Future of Life Institute
Escolta:

El Future of Life Institute, l'organització que promou l'avaluació independent de la seguretat de la intel·ligència artificial, publica des de fa dos anys un índex semestral que qualifica les grans empreses del sector amb notes a l'estil del sistema universitari nord-americà, de la A a la F. L'edició d'hivern de 2025 ja havia deixat un balanç mediocre, amb Anthropic al capdavant però sense cap empresa arribant a un notable.

L'edició d'estiu de 2026, publicada el 16 de juliol, avalua nou empreses -Anthropic, OpenAI, Google DeepMind, xAI, Z.ai, Meta, DeepSeek, Alibaba Cloud i Mistral- amb 37 indicadors repartits en sis àmbits (avaluació de riscos, danys actuals, marcs de seguretat, seguretat existencial, governança i transparència informativa), a partir de proves recollides per un panell de set experts independents fins al 3 de juny de 2026. Anthropic torna a liderar amb una C+ (2,66 punts), seguida d'OpenAI i Google DeepMind amb una C; Meta obté una D+, Z.ai i Alibaba Cloud una D-, i xAI (0,65), DeepSeek (0,47) i Mistral (0,33) suspenen amb una F. El professor Stuart Russell, membre del panell, ha declarat que "la cursa de capacitats s'ha tornat més extrema" i que "les empreses s'han allunyat dels compromisos que havien assumit abans", mentre el també expert David Krueger ha qualificat d'"escandalosa" la manca de progrés cap a plans creïbles de seguretat.

L'informe és rellevant perquè confirma, per segona edició consecutiva, que "el millor de la classe és només mediocre": cap de les nou empreses supera la C+, i l'àmbit de seguretat existencial -el que avalua els riscos més greus i a més llarg termini- és el punt més feble de totes elles. El document també assenyala que Anthropic, OpenAI, Google DeepMind i Meta han afeblit o buidat de contingut compromisos previs de pausar unilateralment el desenvolupament si es traspassessin determinats llindars de risc, alguns dels quals ara depenen del que facin els competidors.

L'avaluació es basa en el judici d'un panell d'experts a partir d'informació pública i de qüestionaris a les empreses, no en una auditoria tècnica independent dels models, i el seu tall d'evidències -3 de juny de 2026- deixa fora models llançats després, com Claude Opus 5; cap de les empreses qualificades ha respost encara públicament ni ha qüestionat la metodologia de l'índex.

Mateix tema

Veure tot el tema →

SEGURETAT · 5 MIN

xAI publica en obert el codi de Grok Build després que l'eina pugés al núvol claus SSH i arxius personals sencers sense permís

Un investigador de seguretat va descobrir que l'agent de programació de l'empresa d'Elon Musk enviava repositoris complets -amb claus SSH, gestors de contrasenyes i documents personals- a un servidor de xAI encara que l'usuari hagués desactivat l'opció de compartir dades, un fet que la companyia no va explicar públicament abans de publicar-ne el codi en obert.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.