Des que els models de llenguatge es van fer accessibles a qualsevol, una pregunta ha planat sobre el sector de la seguretat: fins a quin punt permetrien a actors amb poca preparació tècnica dur a terme operacions que fins ara exigien equips especialitzats. Anthropic publica des de fa mesos informes periòdics sobre com detecta i interromp l'ús indegut de Claude, i el del 10 de setembre és, de moment, el més extens.
El document repassa l'activitat interrompuda entre el desembre de 2025 i l'agost de 2026 en set àmbits de dany, i hi detalla casos concrets amb noms en clau. El més destacat és GTG-20006, un grup d'operadors russoparlants —amb tècniques consistents amb l'espionatge vinculat a l'estat rus— que va fer servir Claude per desenvolupar de manera automatitzada programari maliciós capaç de reconstruir-se i tornar-se a desplegar sol quan els productes de seguretat el detectaven, dirigit contra objectius governamentals, militars i diplomàtics d'Ucraïna i Europa. L'informe també documenta GTG-50020, un grup rus que en només quatre dies va atacar una trentena d'empreses d'intel·ligència artificial per robar-los claus d'accés a les seves API, i GTG-54002, una agència de publicitat que operava una xarxa de prop de setanta llocs de notícies falsos i havia publicat més de 8.900 articles en vint idiomes segons els interessos de qui pagava. «La IA ha esborrat la bretxa de mà d'obra i d'eines» que separava els grups amb suport estatal dels atacants individuals, afirma el mateix informe.
La notícia és rellevant perquè aporta, amb noms en clau, xifres i mètodes concrets, una de les fotografies més detallades fetes públiques fins ara de com la intel·ligència artificial generativa comprimeix el temps i l'habilitat necessaris per muntar operacions d'espionatge, frau o desinformació a escala, i perquè ho fa la mateixa empresa que fabrica l'eina, en un exercici de transparència que alhora és també un recordatori de fins a quin punt els seus propis models es poden fer servir malament.
Tota la informació prové de la investigació interna d'Anthropic sobre l'ús de Claude, sense verificació independent per part de tercers, i l'empresa reconeix que evita detallar prou el funcionament tècnic dels atacs per no facilitar-ne la còpia; l'informe, a més, només reflecteix el que passa amb els seus propis models, no amb els de la competència, de manera que no permet saber si aquests patrons són iguals, més grans o més petits en altres plataformes d'IA.