iaintel·ligènciaartificial.cat← Portada

TECNOLOGIA · 5 MIN

Una start-up de Londres diu que el seu agent d'IA, deu vegades més petit, supera Claude i GPT-5.5 replicant recerca científica

Faraday, l'agent de la start-up britànica Inherent, fundada per antics investigadors de Google DeepMind, funciona sobre un model de només 27.000 milions de paràmetres però supera Claude Opus 4.8 d'Anthropic i GPT-5.5 d'OpenAI en un benchmark que mesura si un sistema pot reproduir sol els resultats d'articles científics publicats.

Il·lustració editorial de Una start-up de Londres diu que el seu agent d'IA, deu vegades més petit, supera Claude i GPT-5.5 replicant recerca científica
Escolta:

Els grans laboratoris d'intel·ligència artificial fa mesos que competeixen per construir agents capaços de fer de «científic autònom»: sistemes que no només responguin preguntes, sinó que dissenyin experiments, els executin i n'interpretin els resultats. Inherent, una start-up amb seu a King's Cross, Londres, fundada per antics investigadors de Google DeepMind, ha entrat en aquesta cursa amb un argument poc habitual: no cal el model més gran per fer-ho bé.

El seu agent, batejat Faraday, s'ha posat a prova en un benchmark que consisteix a reproduir de manera independent els resultats d'articles científics ja publicats, sense que se li doni la resposta per endavant. Segons ha explicat Inherent a TechCrunch, Faraday —construït sobre Qwen 3.6, un model de només 27.000 milions de paràmetres— ha superat en aquesta prova tant Claude Opus 4.8 d'Anthropic com GPT-5.5 d'OpenAI, dos sistemes de referència molt més grans i cars d'executar.

El cofundador Edward Hughes ha insistit que l'interès de l'experiment no és tant la puntuació final com el mètode: «la rèplica d'articles és un exercici d'entrenament habitual també per als científics humans», ha dit, i ha explicat que l'equip ha buscat que l'agent desenvolupi «gust per la recerca»: una mena d'instint per triar quins experiments val la pena investigar i com dissenyar-los bé, no només per encertar la resposta final. Inherent va sortir de l'ombra el maig passat amb una ronda llavor de 50 milions de dòlars i té ara una dotzena d'empleats, xifra que preveu portar fins a 20 o 25 abans que acabi l'any.

El resultat és, de moment, una demostració de capacitat en una tasca concreta i acotada —replicar el que ja se sap—, no la prova que Faraday pugui fer ciència nova pel seu compte. Inherent reconeix obertament que el seu objectiu final, construir una IA capaç de descobrir coneixement científic original i no només verificar-ne d'existent, és una ambició molt més difícil que encara no ha demostrat.

Mateix tema

Veure tot el tema →

Butlletí de dissabte

La setmana d’IA, en cinc minuts.