Els agents de programació amb intel·ligència artificial, com GitHub Copilot, Claude Code o Codex, ja no es limiten a respondre una pregunta i prou: encadenen múltiples crides a un model de llenguatge combinades amb execució d'eines -llegir fitxers, executar comandes, provar codi- en bucles gairebé autònoms. Es tracta d'un patró de treball molt diferent del d'un xatbot convencional, però fins ara poc caracteritzat amb dades reals a gran escala, cosa que dificulta dissenyar-hi al voltant una infraestructura eficient.
Un equip de la divisió d'Azure de Microsoft -Banruo Liu, Haoran Qiu, Íñigo Goiri, Rodrigo Fonseca, Ricardo Bianchini i Esha Choukse- ha presentat el 30 de juliol un preprint que analitza una mostra de traces reals de GitHub Copilot corresponents al juny de 2026: 3,2 milions d'usuaris, 13 milions de sessions, 761 milions de crides al model i 95 bilions de tokens en total. Els autors hi troben que les sessions d'agent consisteixen en pocs torns iniciats per l'usuari que despleguen, cadascun, un bucle autònom de crides al model gairebé sempre acompanyades d'execució d'eines; la taxa d'encert de la memòria cau del 90% dins d'un mateix torn al 55% entre torns, i encara més després de canvis de model o compactacions de context. També dissenyen un predictor lleuger del temps d'inactivitat de l'usuari entre torns que en captura entre el 86% i el 90% del total, útil per gestionar millor els recursos de còmput.
El treball és rellevant perquè ofereix la primera caracterització a escala de producció d'aquest tipus de càrrega de treball, amb implicacions directes per als sistemes que serveixen aquests agents: les infraestructures actuals de servei de models de llenguatge, dissenyades pensant en xatbots, no encaixen bé amb els patrons irregulars i de cua llarga que mostren els agents de programació reals.
Es tracta d'un preprint encara sense revisió per parells, basat en una mostra d'un sol producte -GitHub Copilot- i d'un sol mes de dades, el juny de 2026. Els autors no comparen directament aquests resultats amb el comportament d'altres agents de programació com Claude Code o Codex, de manera que no es pot donar per fet que els mateixos patrons s'hi repeteixin exactament igual.