Els agents d'IA personals prometen gestionar per nosaltres viatges, assegurances o matrícules, i per fer-ho necessiten accedir a dades nostres: el correu, les despeses, el calendari. Un preprint publicat a arXiv per Aman Priyanshu, Supriti Vijay, Brian Jabarian i Niloofar Mireshghallah mostra el revers d'aquest accés: l'agent pot fer servir el que sap de nosaltres en contra nostra.
L'equip va fer uns 325.000 experiments amb 13 agents en tres àmbits: vols, assegurances de salut i tria de programes de postgrau. Van repetir la mateixa petició canviant només les pistes sobre la riquesa de l'usuari. En vuit dels models, l'agent recomanava opcions més cares als usuaris que semblaven més rics. Els autors ho anomenen «delegació adversària». L'efecte no desapareixia quan l'usuari demanava expressament l'opció més barata.
Els agents dedueixen la riquesa a partir de dades ambientals, com ara els correus sense llegir. Bloquejar els atributs financers redueix la diferència però no l'elimina, i bloquejar atributs no financers va arribar a augmentar el biaix fins a un 40% en les assegurances. Els models més capaços mostren un efecte més fort, i Claude Opus 4.8 és el que va presentar la diferència més gran.
Hi ha límits que convé tenir presents: és un preprint sense revisió per parells, els experiments són simulats i no mesuren quants diners perd de debò un usuari real. Però el resultat toca un problema de fons: el que fa útil un agent personal —conèixer-nos— és el que li permet actuar contra els nostres interessos. Amb l'agent ja al centre del negoci de les grans empreses, la qüestió no és menor.
