iaintel·ligènciaartificial.cat← Portada

LEGISLACIÓ · 5 MIN

USA Today Co. demanda OpenAI per entrenar els seus models amb articles de 19 diaris i reclama més de 250 milions de dòlars

L'antiga Gannett diu que OpenAI va copiar centenars de milers d'articles protegits i que ChatGPT els resumeix de manera que el lector ja no cal que els vagi a llegir.

Il·lustració generada amb IA: USA Today Co. demanda OpenAI per entrenar els seus models amb articles de 19 diaris i reclama més de 250 milions de dòlars
Il·lustració generada amb IA
Escolta:

USA Today Co., Inc., l'antiga Gannett, i les seves empreses afiliades van presentar dijous 8 d'octubre una demanda contra OpenAI al tribunal federal del districte sud de Nova York. Són propietàries dels drets de 19 capçaleres, com ara USA Today, The Tennessean, el Detroit Free Press o The Arizona Republic. La demanda va acompanyada d'una sol·licitud perquè s'uneixi al conjunt de procediments sobre drets d'autor contra OpenAI que el mateix tribunal ja tramita de manera agrupada.

L'escrit acusa OpenAI d'haver entrenat els models GPT amb centenars de milers d'articles protegits sense autorització, d'haver-ne reproduït el contingut en respostes que substitueixen els originals i d'haver eliminat la informació que identifica l'autoria i els drets. Segons la demanda, hi ha més de 160.000 registres de contingut seu al conjunt de dades WebText, 83.266 dels quals vénen d'usatoday.com, i més de 122 milions de *tokens* (unitats de text) al corpus C4. Reclama un judici amb jurat i més de 250 milions de dòlars de danys, amb les xifres màximes que preveu la llei: 150.000 dòlars per infracció dolosa i 25.000 per cada eliminació de la informació de drets.

La demanda cita declaracions internes que atribueix a directius d'OpenAI, com ara la d'una vicepresidenta de recerca: «Entrenem les nostres xarxes perquè memoritzin les dades d'entrenament: aquest és el seu objectiu». També hi diu que Microsoft va facilitar a OpenAI una còpia de l'índex de Bing i que els filtres de ChatGPT no tapaven el contingut d'entitats que encara no havien demandat. Com a prova, adjunta exemples en què GPT-5.6 resumeix, secció per secció, articles que es demanen pel títol. Segons el text, OpenAI va ajustar els models perquè resumeixin en comptes de retornar l'article, i el cap de ChatGPT hauria dit que no hi ha «cap bona raó» per clicar en un enllaç de la font.

Cal llegir-la amb prudència. És un escrit d'una de les parts, que encara no ha estat provat ni contestat, i l'article que el resumeix no inclou cap resposta d'OpenAI. Aquest cas se suma a altres demandes de mitjans contra les empreses d'IA i planteja a un jutge la mateixa pregunta de fons: fins a on arriba l'ús legítim quan un model aprèn d'un diari i després en reprodueix la substància.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.