iaintel·ligènciaartificial.cat← Portada

CIBERSEGURETAT · 5 MIN

OpenAI confirma que el seu pròxim model, Astra, ha superat el llindar crític de capacitat cibernètica

OpenAI ha confirmat que proves internes situen Astra, el seu pròxim gran model, per sobre del llindar «crític» de capacitat cibernètica del seu marc de preparació: pot trobar i explotar sol vulnerabilitats desconegudes en sistemes ben protegits, i l'empresa hi aplica salvaguardes reforçades abans de llançar-lo.

Il·lustració editorial de OpenAI confirma que el seu pròxim model, Astra, ha superat el llindar crític de capacitat cibernètica
Escolta:

OpenAI classifica els seus models sota un «Marc de preparació» (Preparedness Framework) des del 2023, que fixa llindars de capacitat en àmbits com la ciberseguretat i preveu mesures de seguretat progressivament més estrictes a mesura que un model s'hi acosta. El 7 d'agost del 2026 l'empresa ja havia avançat que no podia descartar que Astra, el seu pròxim gran model encara en desenvolupament, s'acostés a aquest nivell, i havia introduït una pausa de dues setmanes en l'entrenament per reforçar-ne les proves.

OpenAI ha confirmat aquesta setmana, en declaracions recollides per Business Standard i altres mitjans, que Astra ha superat efectivament el llindar «crític» de capacitat cibernètica: pot identificar vulnerabilitats de dia zero de qualsevol gravetat en sistemes reals ben protegits i executar-ne l'atac de cap a cap a partir de només un objectiu d'alt nivell, sense necessitat de guiar-lo pas a pas. Segons Amelia Glaese, vicepresidenta d'OpenAI, l'empresa ha endurit els controls perquè sigui més difícil que Astra atengui peticions cibernètiques malicioses i ha reforçat la vigilància per detectar intents de saltar-se aquestes salvaguardes, mesures que reconeix que «de vegades alentiran, pausaran o aturaran treball legítim». Sam Altman ha dit a X que Astra encara es llançarà «aviat», en una fase en què l'empresa aplica «cautela» per equilibrar capacitat i seguretat, i que estarà disponible per a un grup reduït d'organitzacions.

És, segons les fonts consultades, el primer cop que un dels grans laboratoris d'IA activa formalment el nivell més estricte de salvaguardes del seu propi marc de seguretat abans de llançar un model, cosa que trenca amb la pràctica fins ara de llançar primer i reaccionar després. Que un model pugui trobar i explotar sol vulnerabilitats de dia zero en sistemes ben protegits sense guiar-lo pas a pas és un salt qualitatiu respecte a les eines de ciberseguretat assistides per IA existents, i planteja per primer cop de manera concreta el dilema entre accelerar les capacitats defensives dels equips de seguretat i obrir la porta a atacants amb accés al mateix model.

OpenAI ha aclarit que Astra no va tenir cap paper en la intrusió d'agents d'IA a Hugging Face del juliol passat, tot i que aquell incident va accelerar la revisió de seguretat general de l'empresa. No hi ha data de llançament públic ni detalls sobre com Astra es compararà amb els models de la competència en aquest mateix llindar, i l'anunci es basa en la pròpia avaluació interna d'OpenAI del seu marc de preparació, sense una auditoria externa independent que en confirmi les xifres.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.