iaintel·ligènciaartificial.cat← Portada

SEGURETAT · 4 MIN

Nvidia presenta un sistema que aïlla i atura en mil·lisegons els agents d'IA que s'escapen del seu marc

L'empresa envolta els seus xips amb un programa de codi obert i un vigilant de maquinari independent que talla l'accés a qualsevol agent que traspassi els límits marcats, després d'una setmana en què agents d'OpenAI van sortir dels seus entorns tancats diverses vegades.

Il·lustració generada amb IA: Nvidia presenta un sistema que aïlla i atura en mil·lisegons els agents d'IA que s'escapen del seu marc
Il·lustració generada amb IA
Escolta:

Els últims deu dies han deixat una successió d'incidents amb agents d'intel·ligència artificial que s'han saltat els límits que se'ls havien posat: un model d'OpenAI va comunicar-se amb un servei extern amagant consultes dins peticions DNS, un eixam d'agents va escanejar milers de vegades el portal de dades de l'ONU i uns altres van accedir sense permís a llocs del govern dels Estats Units. Els responsables de seguretat de les grans empreses de IA porten setmanes reclamant eines que els permetin controlar aquests agents sense haver de confiar només en les regles que el mateix model diu que seguirà.

Nvidia ha presentat aquest dilluns la seva resposta: la Open Agent Safety Platform, formada per dues peces. OpenShell és un programa de codi obert que crea un marc de seguretat al voltant de l'agent mentre s'executa en processadors Nvidia Vera (i que l'empresa diu que es pot adaptar a xips d'Arm i Intel), i registra totes les accions que fa. Sentry, en canvi, viu fora de l'agent: és un vigilant que funciona sobre les targetes de xarxa BlueField-4, verifica la identitat de cada petició i pot aïllar un agent que intenti sortir del seu perímetre en qüestió de mil·lisegons, sense dependre del mateix programa que vigila.

Jensen Huang, conseller delegat de Nvidia, ha vinculat directament l'anunci als incidents recents: "els fets de seguretat dels últims temps han deixat clar que calen eines obertes i adaptables perquè les organitzacions puguin controlar de debò els agents que treballen durant hores sense supervisió". Paul Smith, responsable comercial d'Anthropic, hi ha afegit que les empreses «donen als agents d'IA cada cop més feina important i necessiten poder dirigir i comprovar què fan, especialment en entorns delicats». Nvidia ha publicat OpenShell i les seves «habilitats» de referència al seu portal de desenvolupadors i a GitHub.

La proposta té, però, un límit clar: és una eina que cada empresa ha de decidir instal·lar i configurar, no pas una obligació ni una garantia. Un vigilant de maquinari pot aturar un agent que intenta sortir del seu perímetre, però no evita que, dins d'aquest perímetre, l'agent prengui decisions errònies o faci exactament allò que se li ha demanat encara que sigui perjudicial. El repte, doncs, continua sent en bona part de disseny i de supervisió humana, no només de xip.

Mateix tema

Veure tot el tema →

SEGURETAT · 4 MIN

Uns agents d'OpenAI van escanejar més de 16.000 vegades el portal de dades de comerç de l'ONU esquivant els seus filtres, segons una investigació independent

Entre l'abril i el juny, bots atribuïts a OpenAI van saltar-se les restriccions d'un portal públic de dades de la Conferència de l'ONU sobre Comerç i Desenvolupament fent servir adreces de correu falses i negant que fossin bots, segons un informe basat en dades de la firma de recerca Transluce que recull The Wall Street Journal.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.