iaintel·ligènciaartificial.cat← Portada

PRIVACITAT · 5 MIN

Centenars de contractistes d'OpenAI llegeixen converses reals de ChatGPT per millorar les respostes del model

Una investigació de 404 Media destapa «Project Lily», un programa intern amb centenars de revisors externs, pagats per hora a través de la plataforma Mercor, que puntuen respostes de ChatGPT sobre converses reals d'usuaris que de vegades contenen dades sensibles.

Il·lustració editorial de Centenars de contractistes d'OpenAI llegeixen converses reals de ChatGPT per millorar les respostes del model
Escolta:

Els grans models de llenguatge no milloren només amb més dades d'entrenament: les empreses que els operen fan servir també equips humans que revisen respostes reals per afinar-los, un procés conegut com a «reinforcement learning from human feedback». El que fins ara es coneixia poc eren els detalls concrets de com OpenAI organitza aquesta revisió sobre converses de ChatGPT ja en producció, amb usuaris reals que no necessàriament saben que algú els pot llegir.

Segons una investigació publicada dilluns per 404 Media, OpenAI gestiona internament un programa amb nom en clau «Project Lily» que contracta centenars de revisors externs —reclutats per l'empresa Crossing Hurdles i pagats a través de la plataforma Mercor, alguns a més de 50 dòlars l'hora— perquè puntuin, en una escala de l'1 al 7, la qualitat de respostes reals de ChatGPT davant de sol·licituds igualment reals d'usuaris. Els contractistes no veuen els noms d'usuari, i OpenAI afirma que intenta eliminar informació personal identificable abans que els xats arribin als revisors, però la mateixa companyia reconeix que dades sensibles hi poden acabar passant igualment.

La pràctica no és exclusiva d'OpenAI —Anthropic i Google fan servir programes de revisió humana similars per als seus propis models— però la investigació de 404 Media n'exposa l'escala i l'organització concretes just quan creix la preocupació pública sobre fins a quin punt les converses amb un xatbot es tracten com a privades. Per a molts usuaris que fan servir ChatGPT per a qüestions personals, mèdiques o legals, saber que persones alienes a l'empresa poden arribar a llegir fragments de les seves converses xoca amb la percepció d'estar parlant amb una màquina en un espai tancat.

Ni 404 Media ni OpenAI precisen quin percentatge de converses arriba als revisors humans ni amb quina freqüència hi apareixen dades sensibles pese als filtres, de manera que l'abast real del problema —més enllà del testimoni d'un treballador consultat— resta per xifrar; OpenAI no ha anunciat cap canvi al programa arran de la publicació.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.