Des de fa un any, Anthropic publica informes periòdics sobre com detecta i talla l'ús maliciós de Claude, en set categories que van de les operacions cibernètiques i la vigilància política fins al mal ús biològic i el desenvolupament d'armes convencionals; fins ara, l'empresa havia pogut assegurar que els seus models de referència quedaven prou per sota del llindar en què podrien ajudar de debò a algú a fabricar una arma biològica.
L'informe «Countering misuse of AI: September 2026», que repassa l'activitat detectada i tallada entre desembre de 2025 i agost de 2026, descriu cinc casos concrets en què investigadors van fer servir Claude per a recerca amb potencial de causar dany: una sol·licitud d'ajuda per redactar una proposta de subvenció sobre recerca de «guany de funció» amb el virus del chikungunya, un cas d'experiments d'adaptació a mamífers del virus de la grip aviar -en què l'investigador va accedir a Claude mitjançant un servidor privat virtual i va passar setmanes planificant els experiments abans que Anthropic el detectés i li tanqués l'accés-, sol·licituds de subvenció sobre evasió immunitària d'ortopoxvirus, i treballs d'optimització de pèptids de verí i redisseny de toxines. Segons l'empresa, els casos van implicar Claude Haiku, Sonnet i Opus, no els seus models Fable o Mythos de darrera generació, però per primera vegada Anthropic reconeix que «ja no es pot donar per fet» que els seus models més nous quedin de manera fiable per sota del llindar d'assistència significativa a la fabricació de bioarmes.
És el primer reconeixement públic d'un gran laboratori d'IA que un dels seus productes podria haver estat demanat per ajudar a desenvolupar armes biològiques, un pas que trenca amb el to més tranquil·litzador d'informes anteriors i arriba just quan el mateix conseller delegat d'Anthropic, Dario Amodei, encapçala la crida pública a «pacar» el ritme de millora dels models per motius de seguretat; l'informe mateix inclou, en altres categories, un cas d'actors d'espionatge russos que van robar un kit complet de desenvolupament de programari d'un sistema de visió per a drons.
Anthropic subratlla que els investigadors implicats en els casos de bioseguretat són científics en actiu i que «no afirmem que tinguessin intenció de fer mal», tot i que el fet que alguns busquessin vies alternatives quan Claude els bloquejava l'ha portat a considerar-los sospitosos. L'informe no permet saber quants intents similars no s'han detectat, es limita als casos que Anthropic mateixa ha pogut identificar i tallar, i no hi ha cap verificació independent externa de les xifres ni del llindar de risc que l'empresa diu haver creuat.