Anthropic ja fa mesos que distingeix entre les versions d'ús general dels seus grans models i variants amb salvaguardes reforçades reservades a usos sensibles, una manera d'oferir més capacitat en àmbits com la ciberseguretat o la biologia sense obrir-los a qualsevol usuari. L'1 de setembre l'empresa ha renovat aquesta parella amb Claude Fable 5.1, disponible per a tothom, i Claude Mythos 5.1, amb accés restringit.
Segons el comunicat de la companyia, els dos models comparteixen la mateixa base però difereixen en el nivell de salvaguardes: Fable 5.1 ja es pot fer servir a Claude.ai, l'API (amb l'identificador claude-fable-5-1), Amazon Web Services, Google Cloud i Microsoft Azure, mentre que Mythos 5.1 només arriba a professionals verificats de ciberseguretat defensiva, a través d'un programa de verificació cibernètica, i a investigadors biomèdics dels Estats Units, a través del programa equivalent en ciències de la vida. Anthropic xifra la millora respecte a Fable 5 en proves internes pròpies: del 24,7% al 52,6% en un banc de proves de tasques científiques (Terminal-Bench-Science) i del 42% a fins al 60,9% en programació agèntica (Terminal-Bench 4.0), alhora que abarateix un 75% el preu de lectura de memòria cau, fins a 0,25 dòlars per milió de testimonis.
La companyia també destaca resultats concrets fets amb els nous models: un agent va dissenyar molècules que s'enganxen al seu objectiu amb una potència deu vegades superior a les propostes rivals i una taxa d'èxit del 50% (davant el 10-15% habitual), i un altre exercici amb dades antigues de la NASA va generar mapes d'elevació de Venus amb una resolució de 2-3 km, un 25% més precisos que els existents. Que Anthropic reservi la versió amb menys restriccions, Mythos, a usuaris verificats en dos àmbits molt concrets —ciberseguretat i biologia— mostra fins a quin punt l'empresa tracta aquestes dues disciplines com les de més risc de mal ús dels seus propis models.
Totes les xifres de rendiment i els casos d'ús científics provenen de proves fetes per la mateixa Anthropic, sense verificació independent, i el comunicat no detalla quants professionals han estat verificats fins ara per accedir a Mythos 5.1 ni quant de temps triga el procés. Tampoc s'hi especifica com es compararan aquests models amb els llançaments que puguin fer pròximament OpenAI o Google.