iaintel·ligènciaartificial.cat← Portada

TECNOLOGIA · 5 MIN

Anthropic llança Claude Opus 5 i el presenta com el seu model més segur i, alhora, el més eficient en cost de la gamma Opus

El nou model és ara per defecte a Claude Max i l'opció més potent a Claude Pro, amb millores destacades en programació, ús de l'ordinador i raonament, al mateix preu que el seu predecessor Opus 4.8.

Il·lustració editorial de Anthropic llança Claude Opus 5 i el presenta com el seu model més segur i, alhora, el més eficient en cost de la gamma Opus
Escolta:

Anthropic va presentar aquest 24 de juliol Claude Opus 5, la nova versió del seu model de gamma alta, que substitueix Opus 4.8 com a motor per defecte del pla Claude Max i com l'opció més potent disponible a Claude Pro. L'empresa el descriu com un model pensat especialment per a agents que treballen de manera autònoma durant llargs períodes de temps i per a tasques professionals complexes, en la línia de la competència que manté amb OpenAI i Google pel lideratge dels models de frontera.

Segons les dades publicades per la mateixa Anthropic, Opus 5 dobla el rendiment d'Opus 4.8 al benchmark Frontier-Bench v0.1 de programació, triplica el següent millor model a ARC-AGI 3 (una prova de resolució de problemes nous) i supera tots els models rivals a OSWorld 2.0, la prova d'ús autònom d'ordinadors, amb un cost aproximadament tres vegades inferior. El preu es manté igual que el d'Opus 4.8, 5 dòlars per milió de tocs d'entrada i 25 per milió de sortida, i el model ja és disponible a totes les plataformes, amb un mode ràpid opcional a 2,5 vegades la velocitat pel doble de preu. En seguretat, Anthropic afirma que Opus 5 és el seu model més alineat fins ara, amb una puntuació de 2,3 sobre el comportament desalineat global, la més baixa de la seva família recent de models.

La rellevància de l'anunci és doble: reforça la Anthropic com a actor capaç de llançar models de frontera a un ritme sostingut —després de Sonnet 5 el 30 de juny— i incideix en l'argument comercial que la companyia repeteix des de fa mesos, que es pot oferir intel·ligència de nivell capdavanter sense disparar-ne el cost, en un moment en què la despesa en infraestructura d'IA de tots els grans laboratoris no para de créixer.

Les xifres de rendiment provenen exclusivament de proves internes d'Anthropic, sense benchmarks independents encara publicats, una limitació habitual en els llançaments de models. La mateixa companyia reconeix, a més, que Opus 5 queda per darrere d'una altra variant interna, anomenada Mythos 5, en tasques d'explotació de vulnerabilitats de ciberseguretat i de recerca autònoma en biologia, un matís que Anthropic inclou en el seu propi informe de seguretat però que caldrà veure com es tradueix en la pràctica.

Mateix tema

Veure tot el tema →

Butlletí de dissabte

La setmana d’IA, en cinc minuts.