iaintel·ligènciaartificial.cat← Portada

PRODUCTE · 4 MIN

Thomson Reuters construeix el seu propi model d'IA amb els seus arxius legals i diu que ja rivalitza amb ChatGPT i Claude

L'editorial jurídica ha llançat Thomson, el seu primer model de llenguatge propi, entrenat sobre una base de codi obert amb continguts de Westlaw, Practical Law, Checkpoint i Reuters, amb un cost d'entrenament final d'uns 450.000 dòlars després de dos anys i 40 milions invertits en persones i còmput.

Il·lustració editorial de Thomson Reuters construeix el seu propi model d'IA amb els seus arxius legals i diu que ja rivalitza amb ChatGPT i Claude
Escolta:

Mentre la majoria d'empreses que ofereixen eines d'IA es limiten a connectar els seus productes als models dels grans laboratoris —OpenAI, Anthropic, Google—, Thomson Reuters ha optat per un camí diferent: construir-se el seu propi model de llenguatge a mida, entrenat amb el seu propi arxiu de continguts jurídics i periodístics. L'empresa ha presentat aquesta setmana el resultat, batejat simplement Thomson.

Segons el comunicat de la companyia, Thomson parteix d'una base de codi obert que s'ha reajustat amb els valors i el vocabulari propis de Thomson Reuters, s'ha preentrenat amb continguts de Westlaw, Practical Law, Checkpoint i Reuters, i s'ha post-entrenat amb la guia de professionals del dret i tècniques de reforç perquè sàpiga fer servir les eines internes de l'empresa. Tot el procés ha costat uns 40 milions de dòlars en dos anys entre talent i còmput, però gràcies a diverses eficiències la darrera tanda d'entrenament final només ha costat uns 450.000 dòlars, una fracció del que costen els models dels grans laboratoris, segons la mateixa empresa. Thomson Reuters remarca, a més, que només ha fet servir «menys del 10%» de tot el contingut que té disponible, cosa que deixa marge per a versions futures. El model es començarà a desplegar dins de Tabular Analysis, una funció de CoCounsel Legal pensada per revisar grans volums de documents estructurats.

La rellevància de l'anunci no és tant tècnica com estratègica: mostra que una empresa amb un arxiu de dades propi molt específic pot construir un model competitiu en el seu domini sense els pressupostos multimilionaris dels laboratoris d'IA generalistes, si aprofita bé les dades que ja té. Segons Thomson Reuters, les primeres avaluacions situen Thomson a l'altura dels models capdavanters en un ventall de tasques, i alguns professors de dret que l'han provat han destacat que enllaça directament als tractats i fonts legals que fa servir per respondre, una transparència que valoren per damunt de la d'altres assistents generalistes.

Aquestes comparacions, però, provenen de l'empresa mateixa i d'avaluacions internes o d'acadèmics convidats a provar-lo, sense que hi hagi encara una comparativa independent que confirmi el rendiment de Thomson fora del seu domini d'especialitat legal. És, també, un model pensat per a una tasca molt concreta —la revisió documental jurídica—, no un assistent de propòsit general, i el seu desplegament real a bufets i departaments legals just ara comença.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.