iaintel·ligènciaartificial.cat← Portada

CIBERSEGURETAT · 5 MIN

Els EUA acusen sis empreses xineses d'IA de fer de la destil·lació massiva dels models nord-americans el nucli, no un complement, de la seva estratègia

Una alerta conjunta de la NSA, la CISA i l'FBI assenyala DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun i Z.AI per haver extret «milers de milions de tokens» de Claude, ChatGPT, Gemini i Grok des de finals del 2024, a través d'un «mercat gris» de servidors pont per esquivar les restriccions d'accés.

Il·lustració editorial de Els EUA acusen sis empreses xineses d'IA de fer de la destil·lació massiva dels models nord-americans el nucli, no un complement, de la seva estratègia
Escolta:

La destil·lació de coneixement —entrenar un model més petit i barat a partir de les respostes d'un model més gran i car— és una tècnica legítima d'aprenentatge automàtic, però es pot fer servir també per copiar de facto les capacitats d'un competidor amb molt menys temps i cost que desenvolupar-les de manera pròpia. El juliol passat ja hi havia hagut una acusació puntual de la Casa Blanca contra Moonshot AI en aquest sentit; el que faltava era una avaluació conjunta i formal de les agències de seguretat nord-americanes sobre l'abast real del fenomen.

La National Security Agency, la Cybersecurity and Infrastructure Security Agency i l'FBI han publicat el 8 de setembre l'alerta conjunta AA26-251A, que assenyala sis empreses xineses d'IA —DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun i Z.AI— per haver dut a terme, des de finals del 2024, campanyes de destil·lació a escala industrial contra els models dels laboratoris nord-americans Anthropic (Claude), OpenAI (GPT), Google (Gemini) i xAI (Grok), amb «milers de milions de tokens» extrets a través de milions de peticions. Segons el document, DeepSeek va destil·lar Claude 3.7, Claude Sonnet 4 i 4.5, Claude Opus 4.1, diverses versions de Gemini 2.5 i de GPT-4/4o, GPT-5 i Grok 4 per entrenar els seus models R1 i V3, mentre Moonshot AI hauria extret dades de Claude Fable 5 per al seu Kimi-K3 i de GPT-4o per al Kimi-K2, sovint a través d'un «mercat gris de servidors pont» que camufla l'origen de les peticions. L'alerta afirma que aquestes campanyes «formen el nucli —no només un complement— » de l'estratègia de desenvolupament d'aquestes empreses, i qüestiona directament la xifra de 5,6 milions de dòlars que DeepSeek va donar com a cost d'entrenament del R1, que qualifica d'«enganyosa» perquè no inclouria el cost real de les dades obtingudes per aquesta via.

La notícia és rellevant perquè és la primera vegada que tres agències de seguretat nord-americanes de primer nivell fan una acusació formal i conjunta, amb noms concrets de sis empreses alhora, en lloc de la denúncia puntual i aïllada d'una sola companyia com havia passat el juliol amb Moonshot; posa també xifres i mètodes concrets —el «mercat gris de servidors pont»— a un fenomen del qual fins ara només es tenien indicis dispersos, i reforça la lectura que la competència entre els EUA i la Xina en IA es juga tant en el desenvolupament de models com en l'accés no autoritzat a les capacitats de l'altre.

Cal llegir l'alerta com el que és: una valoració de les agències de seguretat del govern dels EUA, no una sentència judicial ni una investigació independent verificada per tercers, i les sis empreses assenyalades no hi apareixen citades responent a les acusacions. La destil·lació a partir de respostes obtingudes per una API pública ocupa, a més, una zona grisa legal que no està clarament prohibida per la legislació nord-americana, de manera que l'alerta és, de moment, un toc d'atenció de seguretat i de política industrial més que no pas una acusació amb conseqüències legals immediates.

Mateix tema

CIBERSEGURETAT · 4 MIN

Google alerta que un grup criminal ha fet servir agents d'IA autònoms per robar milers de credencials en menys de sis hores

El Google Threat Intelligence Group documenta un atac real en què un actor amb motivació econòmica va desplegar un marc d'agents d'IA que va gestionar sol l'escaneig de vulnerabilitats, la resolució de problemes i la rotació d'adreces IP fins a robar milers de credencials, i detalla un servidor exposat que gestionava més de 23.800 secrets robats.

Butlletí de dissabte

La setmana d’IA, en cinc minuts.