Un equip liderat per Dmitry Kobak, ara a la Universitat de Gant, i Lena Holzwarth i Rita González-Márquez, de l'Institut Hertie per a la IA en la Salut Cerebral de la Universitat de Tübingen, ha actualitzat el mètode que el mateix grup va presentar l'any passat a la revista Science Advances per detectar l'ús de models de llenguatge en articles científics: en lloc de buscar frases sospitoses una per una, comparen com ha evolucionat la freqüència de centenars de paraules «d'estil» —com «delves» o «underscores» en anglès— respecte a la tendència que ja tenien abans que ChatGPT es fes públic el novembre del 2022.
El nou preprint, penjat a arXiv l'11 d'agost, amplia l'anàlisi a 1.194.287 articles biomèdics en anglès de PubMed Central publicats entre el 2017 i el final del 2025. Els autors hi troben que la proporció de treballs amb un excés estadísticament significatiu d'aquest vocabulari d'IA ha passat del 19% l'any 2023 al 52% el 2024, fins a una mitjana del 77% al llarg del 2025 i gairebé el 89% en els articles publicats el desembre d'aquell any. L'ús no es reparteix igual per seccions: arriba al 68% als paràgrafs de la Discussió, per un 32% als de Mètodes, i és més alt als països de parla no anglesa —per damunt del 80% a Corea del Sud, la Xina i Taiwan— que als de parla anglesa.
Els mateixos autors comparen l'abast d'aquest canvi amb el que van provocar altres esdeveniments recents en el vocabulari científic, com la pandèmia de covid-19, i conclouen que l'efecte dels models de llenguatge en com s'escriuen els articles biomèdics ja l'ha superat en magnitud. La xifra no mesura si el contingut científic és fiable ni si hi ha frau, sinó fins a quin punt l'escriptura —redactar, revisar o polir un text ja fet— passa avui per una eina d'IA generativa, una pràctica que moltes revistes permeten si es declara i que d'altres prohibeixen sense excepcions clares.
El treball és, de moment, un preprint que encara no ha passat la revisió per parells en aquesta versió ampliada, tot i que es basa en una metodologia ja publicada i revisada a Science Advances amb dades més limitades el 2025. El mètode detecta un patró estadístic d'excés de vocabulari, no una prova directa que un autor concret hagi fet servir IA en un article concret, i els mateixos investigadors adverteixen que caldrà una discussió sobre polítiques acadèmiques que encara no existeix de manera uniforme entre revistes.