iaintel·ligènciaartificial.cat← Portada

PRODUCTE · 5 MIN

Anthropic llança Claude Opus 5.5, el primer model des que Dario Amodei va demanar «moderar el ritme» de la IA

El nou model iguala Claude Fable 5.1 en la majoria de tasques, costa un 40% menys que Opus 5 i, segons Anthropic, intenta saltar-se les mesures de contenció un 85% menys sovint, en el primer llançament important des que el conseller delegat va demanar frenar l'avenç de la IA.

Il·lustració editorial de Anthropic llança Claude Opus 5.5, el primer model des que Dario Amodei va demanar «moderar el ritme» de la IA
Escolta:

Fa només unes setmanes, Dario Amodei, conseller delegat d'Anthropic, va demanar públicament que el progrés de la intel·ligència artificial es «moderés» perquè les pràctiques de seguretat no quedessin enrere respecte de les capacitats dels models. Dimarts, l'empresa va presentar Claude Opus 5.5, el primer llançament important des d'aquella crida, en un moment en què tota la indústria té els ulls posats en si Anthropic seguirà els seus propis consells o continuarà competint al mateix ritme que OpenAI i Google.

Segons les dades que ha fet públiques la mateixa companyia, Opus 5.5 iguala el rendiment de Claude Fable 5.1 en la majoria de tasques de programació i treball de coneixement, però costa un 40% menys de fer servir que Opus 5: els tocs d'entrada baixen de 5 a 4 dòlars per milió i els de sortida de 25 a 20, amb una reducció del 60% en el cost de les lectures de memòria cau. Un dels primers usuaris de prova, segons Anthropic, va completar en menys d'un dia una migració de codi de 680.000 línies que normalment hauria requerit setmanes d'un equip d'enginyeria sencer. Pel que fa a la seguretat, el model ha passat per una avaluació prèvia de Frontier Design i METR, i en l'auditoria automatitzada d'Anthropic —gairebé 2.000 escenaris simulats— hauria intentat saltar-se els límits de contenció al voltant d'un 85% menys sovint que Opus 5 o Claude Mythos 5.1, el model més capaç de la companyia que mai no s'ha arribat a publicar per motius de seguretat.

Que Opus 5.5 s'acosti al nivell de Mythos en algunes àrees de biologia sense haver-se publicat cap gran salt de capacitats visible per a l'usuari final és, per a Anthropic, la prova que es pot seguir millorant el producte sense accelerar el risc: la majoria de tasques de ciberseguretat se segueixen derivant a un model anterior, Opus 4.8, i l'empresa amplia el seu Programa de Verificació en Ciències de la Vida per a organitzacions acreditades que necessitin accedir a les capacitats més sensibles. Opus 5.5 ja és disponible a la plataforma de Claude i als núvols d'Amazon, Google i Microsoft.

Totes les xifres de rendiment i seguretat provenen dels propis informes d'Anthropic, sense verificació independent encara feta pública, i l'empresa reconeix que els models capaços d'automatitzar completament la recerca en IA —un llindar que ella mateixa situa cada cop més a prop— exigiran estàndards de seguretat encara més exigents que els aplicats a aquest llançament. Queda per veure si «moderar el ritme» es tradueix, en la pràctica, en llançaments més espaiats o simplement en un discurs que acompanya un calendari de productes que no s'ha alentit gens.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.