El Future of Life Institute, l'organització que promou l'avaluació independent de la seguretat de la intel·ligència artificial, publica des de fa dos anys un índex semestral que qualifica les grans empreses del sector amb notes a l'estil del sistema universitari nord-americà, de la A a la F. L'edició d'hivern de 2025 ja havia deixat un balanç mediocre, amb Anthropic al capdavant però sense cap empresa arribant a un notable.
L'edició d'estiu de 2026, publicada el 16 de juliol, avalua nou empreses -Anthropic, OpenAI, Google DeepMind, xAI, Z.ai, Meta, DeepSeek, Alibaba Cloud i Mistral- amb 37 indicadors repartits en sis àmbits (avaluació de riscos, danys actuals, marcs de seguretat, seguretat existencial, governança i transparència informativa), a partir de proves recollides per un panell de set experts independents fins al 3 de juny de 2026. Anthropic torna a liderar amb una C+ (2,66 punts), seguida d'OpenAI i Google DeepMind amb una C; Meta obté una D+, Z.ai i Alibaba Cloud una D-, i xAI (0,65), DeepSeek (0,47) i Mistral (0,33) suspenen amb una F. El professor Stuart Russell, membre del panell, ha declarat que "la cursa de capacitats s'ha tornat més extrema" i que "les empreses s'han allunyat dels compromisos que havien assumit abans", mentre el també expert David Krueger ha qualificat d'"escandalosa" la manca de progrés cap a plans creïbles de seguretat.
L'informe és rellevant perquè confirma, per segona edició consecutiva, que "el millor de la classe és només mediocre": cap de les nou empreses supera la C+, i l'àmbit de seguretat existencial -el que avalua els riscos més greus i a més llarg termini- és el punt més feble de totes elles. El document també assenyala que Anthropic, OpenAI, Google DeepMind i Meta han afeblit o buidat de contingut compromisos previs de pausar unilateralment el desenvolupament si es traspassessin determinats llindars de risc, alguns dels quals ara depenen del que facin els competidors.
L'avaluació es basa en el judici d'un panell d'experts a partir d'informació pública i de qüestionaris a les empreses, no en una auditoria tècnica independent dels models, i el seu tall d'evidències -3 de juny de 2026- deixa fora models llançats després, com Claude Opus 5; cap de les empreses qualificades ha respost encara públicament ni ha qüestionat la metodologia de l'índex.