iaintel·ligènciaartificial.cat← Portada

PRODUCTE · 4 MIN

Anthropic activa per defecte el mode automàtic de Claude Code, que actua sense demanar permís a cada pas

A partir del 14 d'agost, els comptes Pro, Max i Team de l'eina de programació d'Anthropic executaran accions sense aturar-se a demanar confirmació humana, després que una prova amb més de mil usuaris de pagament mostrés que el mode automàtic detecta més accions perilloses que la revisió manual.

Il·lustració editorial de Anthropic activa per defecte el mode automàtic de Claude Code, que actua sense demanar permís a cada pas
Escolta:

Claude Code és l'eina de programació agèntica d'Anthropic, que fins ara demanava confirmació humana abans de cada acció potencialment sensible -esborrar fitxers, instal·lar dependències, executar ordres al sistema. Aquest model de "permís pas a pas" es va dissenyar per mantenir un humà al mig de cada decisió, però amb agents que encadenen desenes d'accions per completar una tasca, les interrupcions constants frenaven el ritme de treball.

Anthropic va anunciar el 9 d'agost que, a partir del 14 d'agost, el "mode automàtic" (auto mode) passarà a ser l'opció per defecte als comptes Pro, Max i Team de Claude Code: l'eina executarà les accions sense aturar-se a demanar-hi permís, tret que les consideri irreversibles, destructives o fora de l'àmbit de la tasca encarregada. La companyia hi afegeix noves proteccions, com un filtre contra la injecció d'instruccions ocultes ("prompt injection") i regles de denegació que l'usuari pot personalitzar per blindar dades sensibles. Segons Anthropic, en una prova amb 1.053 usuaris de pagament, el mode automàtic va detectar el 89% de les accions perilloses, davant només el 13,6% que va aturar la revisió manual humana, perquè els usuaris acaben aprovant el 97% de les peticions de permís sense parar-s'hi a pensar. Boris Cherny, cap de Claude Code, ho ha resumit dient: "L'equip i jo fem servir el mode automàtic exclusivament, i fa mesos que ho fem. No m'imagino tornar als avisos de permís."

La notícia és rellevant perquè inverteix l'argument habitual sobre la supervisió humana dels agents d'IA: Anthropic sosté que els avisos de permís freqüents no fan la gent més segura, sinó més descuidada, i que un sistema automatitzat ben dissenyat detecta més riscos que una persona que aprova gairebé tot per inèrcia. És també un indicador de fins a quin punt Anthropic confia que Claude Code pot operar amb autonomia en tasques de programació rutinàries, just quan la companyia mateixa ha reconegut en setmanes anteriors que versions de Claude han vulnerat sistemes reals durant proves de ciberseguretat.

Les xifres de detecció provenen d'una prova interna d'Anthropic amb els seus propis usuaris de pagament, sense una auditoria externa que les confirmi, i la companyia no ha detallat quins tipus concrets d'accions "irreversibles o destructives" continuaran aturant-se per demanar permís humà. El canvi només afecta Claude Code, no la resta de productes d'Anthropic, i encara falta veure com respon el mode automàtic quan s'apliqui a la totalitat dels usuaris de pagament, molt més nombrosos que els 1.053 de la prova.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.