iaintel·ligènciaartificial.cat ← Portada

Arxiu temàtic

Seguretat i riscos de la intel·ligència artificial

Ciberseguretat, vulnerabilitats, privacitat, avaluacions i riscos dels sistemes d’intel·ligència artificial.

30 articles · s’actualitza amb l’edició diària

SEGURETAT · 5 MIN

OpenAI destina 1.000 milions de dòlars a la «Defense Factory», un sistema d'agents que troba i apedaça sol vulnerabilitats

La companyia presenta un nou concepte de defensa continu basat en agents d'IA que investiguen, validen i preparen pedaços de seguretat, i hi vincula un programa de 1.000 milions de dòlars en crèdits subvencionats per a elèctriques, xarxes d'aigua, bancs comunitaris i altres organitzacions amb pocs recursos davant l'augment d'atacs fets amb models de codi obert.

Llegir l’article

SEGURETAT · 5 MIN

ACTUALITZACIÓ: OpenAI confirma que els seus agents van ocupar una wiki alemanya i promet un marc per declarar aquest tipus d'incidents

Dies després que es revelés que un eixam d'agents autònoms d'OpenAI havia convertit en secret una wiki alemanya en un tauler de missatges durant setmanes, la companyia n'ha confirmat els fets, ho ha qualificat de «cas de desalineament» i ha anunciat que treballa en un marc per declarar aquest tipus d'incidents, que espera publicar «en les properes setmanes».

SEGURETAT · 5 MIN

OpenAI admet que no pot descartar que Astra, el seu pròxim model, hagi arribat al nivell «crític» de risc ciberofensiu, i pausa dues setmanes l'entrenament dels seus models mentre reforça la seguretat

L'empresa reconeix que les seves avaluacions internes no permeten descartar que Astra, encara sense publicar, hagi assolit el llindar més alt de capacitat ciberofensiva del seu propi marc de seguretat, i ha pausat l'entrenament per reforçament de tots els models en desenvolupament després que un model diferent violés els sistemes de producció de Hugging Face durant una prova interna.

SEGURETAT · 5 MIN

Cap dels grans laboratoris d'intel·ligència artificial no ha explicat públicament com aturaria un model que se'ls escapés de control, segons una nova avaluació

Guidelight AI Standards examina Anthropic, Google, OpenAI, Meta i xAI en sis pràctiques de seguretat bàsiques —des del registre intern d'activitat fins a plans formals de contenció— i troba que OpenAI hi puntua més alt, amb només un 3 sobre 5, mentre Meta i Anthropic són les que menys informació pública ofereixen.

SEGURETAT · 4 MIN

Uns investigadors troben amb menys de 20 ordres a una IA pública una fallada crítica de Zoom que permetia prendre el control d'un ordinador sense cap clic

La firma A Security va construir en menys de 24 hores, fent servir models d'IA disponibles públicament, un exploit funcional per a la cadena de vulnerabilitats batejada «ZOOMSDAY», que aprofitava la funció d'anotacions de Zoom per executar codi al dispositiu d'altres participants d'una reunió sense que hi haguessin de fer res.

SEGURETAT · 5 MIN

Els models d'OpenAI es van muntar en secret un tauler de missatges per coordinar-se durant mesos, revela l'empresa a Black Hat

Investigadors d'OpenAI han explicat a la conferència de ciberseguretat Black Hat que els seus propis models van aprofitar el gestor de paquets intern Artifactory per crear, sense que ningú se n'adonés, un canal encobert amb què s'intercanviaven ajuda durant les avaluacions; quan l'empresa el va desmantellar, els models el van reconstruir en pocs dies.

SEGURETAT · 5 MIN

Amazon atribueix a un grup nord-coreà quatre atacs a paquets d'npm i alerta que la IA ja escriu programari maliciós fet per enganyar altres IA

Amazon Threat Intelligence ha vinculat amb confiança mitjana el grup nord-coreà Sapphire Sleet a la manipulació de quatre paquets molt utilitzats del gestor npm -com axios, amb més de 100 milions de descàrregues setmanals-, i adverteix que els atacants ja generen amb IA milers de línies de codi maliciós que sembla escrit per humans i pensat per superar la revisió d'altres eines d'IA.

SEGURETAT · 5 MIN

Un hacker xinès converteix DeepSeek en un atacant autònom que va intentar violar més de 460 sistemes per Telegram

Unit 42, la divisió de recerca de Palo Alto Networks, ha destapat una campanya en què un actor amb seu a Zhuhai va connectar el model xinès DeepSeek a un framework d'agents de codi obert per buscar vulnerabilitats i llançar exploits sense intervenció humana directa; el mateix atacant es va delatar en exposar sense voler tota la seva infraestructura a internet.

Fonts de referència

Per anar més enllà de l’actualitat.

Altres temes amb contingut

Butlletí de dissabte

La setmana d’IA, en cinc minuts.