iaintel·ligènciaartificial.cat← Portada

CIÈNCIA · 4 MIN

Una sola IA s'equivoca triant l'estratègia d'una empresa, però un «eixam» de consultes iguala el criteri d'experts humans

Un estudi de la UCL i Oxford publicat a Strategic Management Journal demostra que les avaluacions individuals d'IA sobre decisions estratègiques són inconsistents i esbiaixades per l'ordre de les opcions, però que agregar-ne moltes reprodueix el judici d'experts humans.

Il·lustració editorial de Una sola IA s'equivoca triant l'estratègia d'una empresa, però un «eixam» de consultes iguala el criteri d'experts humans
Escolta:

Cada cop més directius fan servir la IA generativa per ajudar-se a valorar decisions estratègiques: quin model de negoci és millor, quina opció d'expansió té més sentit. Un equip de la University College London i la Universitat d'Oxford, format per Anil R. Doshi, J. Jason Bell, Emil Mirzayev i Bart Vanneste, ha posat a prova aquesta pràctica en un estudi publicat a Strategic Management Journal.

Els investigadors van fer avaluar 60 models de negoci mitjançant comparacions per parells, amb diversos models de llenguatge grans, deu «rols» diferents assignats a la IA (periodista, professor d'estratègia, expert del sector, entre altres) i dues maneres de formular les preguntes. El resultat: la consistència d'un mateix model en repetir la seva pròpia valoració va oscil·lar «entre poc menys del 30% i prop del 81%», i invertir l'ordre en què es presentaven dues opcions sovint bastava per canviar quina preferia el sistema. En canvi, quan els investigadors van agregar moltes avaluacions fetes amb models, rols i formulacions diferents, el consens resultant s'acostava molt més al judici d'un grup d'experts humans.

La troballa té una lectura pràctica clara per a qualsevol empresa que ja fa servir IA per decidir: preguntar-ho una vegada a un sol model és gairebé un exercici d'atzar, però combinar moltes consultes des d'angles diferents produeix un criteri molt més fiable. Els autors insisteixen que això no substitueix el «pensament de disseny» i el «pensament crític» que exigeix una bona decisió estratègica, capacitats que atribueixen encara als equips humans.

L'estudi es limita a la classificació de models de negoci ja existents, no a decisions reals preses per directius amb conseqüències econòmiques, de manera que no es pot donar per fet que els mateixos resultats es repetirien en un consell d'administració real. Tampoc queda clar quant costaria, en temps i en diners, generar prou consultes agregades per a cada decisió important d'una empresa.

Mateix tema

CIÈNCIA · 4 MIN

Un estudi demostra que les pautes que una IA es fabrica per avaluar-se a si mateixa es poden enganyar fins a un 26% de les vegades

Investigadors de la National University of Singapore, la Universitat de Pequín, l'Institut d'Automàtica de l'Acadèmia Xinesa de Ciències i JD.com posen a prova onze generadors de pautes d'avaluació amb tasques dissenyades perquè l'única resposta honesta sigui reconèixer que no tenen solució, i troben que sovint premien la resposta que enganya millor el sistema.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.