Joe Benton, que fins fa poc dirigia l'equip de supervisió escalable (Scalable Oversight) d'Anthropic, ha explicat aquest dissabte per què va deixar l'empresa fa dues setmanes: «Les empreses d'IA competeixen per construir màquines molt més intel·ligents que qualsevol humà, i potser no sobrevivim a això», ha escrit en la seva declaració de sortida. Benton passa ara a treballar per a METR (Model Evaluation and Threat Research), una organització independent que avalua els riscos de sistemes d'IA de frontera.
Benton atribueix el problema no a la mala fe d'una empresa en concret, sinó a la dinàmica competitiva del sector: diu que la pressió per no quedar-se enrere de la competència empeny totes les grans empreses de IA a infrafinançar de manera crònica les seves mesures de seguretat, perquè la penalització per anar més lenta que un rival és massa severa per assumir-la en solitari. Proposa mesures concretes que voldria veure adoptades pel sector: revelar el progrés cap a l'automillora recursiva dels models, informar d'incidents i quasi-incidents de seguretat, complir estàndards mínims de seguretat i sotmetre's a auditories externes que ho verifiquin. També assegura que molts companys que encara treballen a Anthropic estan «esglaiats» per les capacitats dels sistemes que s'estan desenvolupant.
La dimissió de Benton és la segona en dues setmanes dins d'Anthropic després de la de Jacob Coxon, que també va deixar l'empresa alertant que el sector «aposta amb la vida de tothom» per arribar primer a la superintel·ligència. Que dos investigadors de seguretat de la mateixa empresa dimiteixin amb missatges similars en un espai tan curt de temps —i que ho facin just la mateixa setmana en què Dario Amodei publicava el seu propi pla per «pacar la frontera» i Sam Altman deia que ajornava la sortida a borsa d'OpenAI per motius de seguretat— reforça la sensació que la preocupació per la velocitat de la IA ha deixat de ser un debat merament acadèmic dins dels laboratoris.
Les acusacions de Benton són testimonis personals i no van acompanyades de documents interns ni de dades verificables sobre el pressupost real de seguretat d'Anthropic ni de cap altra empresa del sector; l'empresa no ha fet cap declaració pública detallada en resposta a les seves afirmacions concretes recollida en aquesta informació.