El Future of Life Institute, l'organització que promou l'anomenada carta oberta de 2023 demanant una pausa en l'entrenament de models d'IA més potents que GPT-4, publica des de fa tres edicions un informe semestral que avalua com de seriosament es prenen la seguretat les principals empreses del sector. La convocatòria d'aquest estiu arriba en un moment de competència comercial accelerada, amb els grans laboratoris llançant models nous gairebé cada setmana.

L'informe analitza nou companyies —Anthropic, OpenAI, Google DeepMind, Meta, xAI, DeepSeek, Z.ai, Alibaba Cloud i Mistral— a partir de 37 indicadors agrupats en sis àmbits: avaluació de riscos, danys actuals, marcs de seguretat, seguretat existencial, governança i transparència. Cap empresa supera el C+, la nota que obté Anthropic (2,66 sobre 4), seguida d'OpenAI i Google DeepMind amb un C (2,28 i 2,01). Meta puja fins a un D+ (1,32) i millora posicions respecte a l'edició anterior, mentre que xAI cau del quart al setè lloc amb un F (0,65), igual que DeepSeek (0,47) i Mistral (0,33), les tres úniques suspeses.

Més enllà del rànquing, la troballa central de l'informe és que Anthropic, OpenAI, Google DeepMind i Meta han "afeblit o eliminat" compromisos anteriors de pausar el desenvolupament dels seus sistemes si s'apropaven a llindars de perill determinats, i que diverses companyies han suavitzat la seva resistència als usos militars de la IA per accedir a contractes de defensa i seguretat nacional. Els autors conclouen que el progrés en seguretat comercial "s'ha estancat o ha retrocedit" mentre la competència de mercat s'intensifica.

El Future of Life Institute és una organització amb una posició declarada a favor de frenar el ritme de desenvolupament de la IA, cosa que cal tenir present en llegir les seves conclusions. L'informe es basa en informació publicada per les mateixes empreses i en avaluacions d'experts externs, però no té accés directe als sistemes interns de seguretat de cada companyia, de manera que depèn en bona part de la transparència voluntària de qui està sent avaluat.