iaintel·ligènciaartificial.cat← Portada

CIÈNCIA · 5 MIN

Un estudi de Copenhaguen amb 27 models d'IA troba que els xatbots donen una informació menys variada que un cercador, fins i tot el més divers

La recerca, que es presentarà a l'EMNLP 2026, va analitzar uns 70 milions d'afirmacions sobre 155 temes. El model més divers, GPT-5, oferia almenys un 18,7% menys de varietat que Google Search.

Il·lustració generada amb IA: Un estudi de Copenhaguen amb 27 models d'IA troba que els xatbots donen una informació menys variada que un cercador, fins i tot el més divers
Il·lustració generada amb IA
Escolta:

Cada cop més gent substitueix la cerca a internet per una pregunta a un xatbot. Si els models responen sempre amb una mateixa visió dominant, el risc és que una part de la societat accedeixi a una versió més estreta de la realitat, amb menys punts de vista minoritaris. Un equip del Departament d'Informàtica de la Universitat de Copenhaguen ha volgut mesurar-ho.

El treball, signat per Dustin Wright com a primer autor i Isabelle Augenstein com a investigadora sènior, s'ha acceptat a l'EMNLP 2026, el congrés de processament del llenguatge natural que se celebrarà a Budapest del 24 al 29 d'octubre, i també és disponible a arXiv. Els autors van provar 27 models de llenguatge sobre 155 temes, amb 200 variacions de peticions basades en preguntes reals d'usuaris, i van comparar el que deien amb el que retornava un cercador. En total van analitzar uns 70 milions d'afirmacions.

El resultat és que fins i tot el model més divers, GPT-5, oferia almenys un 18,7% menys d'informació variada que Google Search. Els models més nous mostraven una mica més de diversitat que els antics, però no n'hi havia prou per tancar la diferència. Els investigadors expliquen que els models comprimeixen les dades d'entrenament i reforcen els patrons dominants, mentre que els punts de vista minoritaris queden filtrats.

Els autors avisen d'un possible «col·lapse del coneixement»: si les futures generacions de models s'entrenen amb textos generats per models anteriors, la varietat podria anar minvant. Convé llegir-ho com un advertiment, no com una predicció: l'estudi se centra en uns temes i uns models concrets, i el comportament real de les persones, que sovint consulten diverses fonts, pot ser diferent del que es mesura en un entorn controlat.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.