iaintel·ligènciaartificial.cat← Portada

SEGURETAT · 5 MIN

Cap gran empresa d'IA passa d'un aprovat raspat en seguretat, segons el nou índex del Future of Life Institute

L'edició d'estiu de l'AI Safety Index avalua nou grans empreses d'intel·ligència artificial en 37 indicadors i cap supera la nota de C+: Anthropic lidera per davant d'OpenAI i Google DeepMind, mentre xAI, DeepSeek i Mistral suspenen.

Il·lustració editorial de Cap gran empresa d'IA passa d'un aprovat raspat en seguretat, segons el nou índex del Future of Life Institute
Escolta:

El Future of Life Institute, l'organització que promou l'avaluació independent de la seguretat de la intel·ligència artificial, publica des de fa dos anys un índex semestral que qualifica les grans empreses del sector amb notes a l'estil del sistema universitari nord-americà, de la A a la F. L'edició d'hivern de 2025 ja havia deixat un balanç mediocre, amb Anthropic al capdavant però sense cap empresa arribant a un notable.

L'edició d'estiu de 2026, publicada el 16 de juliol, avalua nou empreses -Anthropic, OpenAI, Google DeepMind, xAI, Z.ai, Meta, DeepSeek, Alibaba Cloud i Mistral- amb 37 indicadors repartits en sis àmbits (avaluació de riscos, danys actuals, marcs de seguretat, seguretat existencial, governança i transparència informativa), a partir de proves recollides per un panell de set experts independents fins al 3 de juny de 2026. Anthropic torna a liderar amb una C+ (2,66 punts), seguida d'OpenAI i Google DeepMind amb una C; Meta obté una D+, Z.ai i Alibaba Cloud una D-, i xAI (0,65), DeepSeek (0,47) i Mistral (0,33) suspenen amb una F. El professor Stuart Russell, membre del panell, ha declarat que "la cursa de capacitats s'ha tornat més extrema" i que "les empreses s'han allunyat dels compromisos que havien assumit abans", mentre el també expert David Krueger ha qualificat d'"escandalosa" la manca de progrés cap a plans creïbles de seguretat.

L'informe és rellevant perquè confirma, per segona edició consecutiva, que "el millor de la classe és només mediocre": cap de les nou empreses supera la C+, i l'àmbit de seguretat existencial -el que avalua els riscos més greus i a més llarg termini- és el punt més feble de totes elles. El document també assenyala que Anthropic, OpenAI, Google DeepMind i Meta han afeblit o buidat de contingut compromisos previs de pausar unilateralment el desenvolupament si es traspassessin determinats llindars de risc, alguns dels quals ara depenen del que facin els competidors.

L'avaluació es basa en el judici d'un panell d'experts a partir d'informació pública i de qüestionaris a les empreses, no en una auditoria tècnica independent dels models, i el seu tall d'evidències -3 de juny de 2026- deixa fora models llançats després, com Claude Opus 5; cap de les empreses qualificades ha respost encara públicament ni ha qüestionat la metodologia de l'índex.

Mateix tema

Veure tot el tema →

SEGURETAT · 5 MIN

OpenAI destina 1.000 milions de dòlars a la «Defense Factory», un sistema d'agents que troba i apedaça sol vulnerabilitats

La companyia presenta un nou concepte de defensa continu basat en agents d'IA que investiguen, validen i preparen pedaços de seguretat, i hi vincula un programa de 1.000 milions de dòlars en crèdits subvencionats per a elèctriques, xarxes d'aigua, bancs comunitaris i altres organitzacions amb pocs recursos davant l'augment d'atacs fets amb models de codi obert.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.