La disponibilitat de xips especialitzats s'ha convertit en un dels principals colls d'ampolla per a l'expansió dels serveis d'IA, i els grans proveïdors de núvol busquen alternatives més eficients als seus propis processadors d'ús general per abaratir el cost de cada resposta generada.
Segons ha informat TechCrunch el 20 de juliol, citant el mitjà The Information i fonts internes anònimes, Google està desenvolupant un xip de servidor intern anomenat "Frozen v2" que grava directament al maquinari bona part de les decisions arquitectòniques del model Gemini, en lloc de limitar-se a emmagatzemar-ne els pesos, cosa que reduiria els passos de processament i el moviment de dades necessaris per generar cada resposta. Segons aquestes fonts, el xip podria arribar a ser entre sis i deu vegades més eficient que les TPU actuals de Google, mesurat en tokens processats per unitat d'energia, i la companyia en preveu el desplegament a partir del 2028. Preguntada per TechCrunch, Google no ha confirmat ni desmentit el projecte i s'ha limitat a assenyalar que "els nostres equips investiguen i experimenten constantment amb noves innovacions per oferir el màxim rendiment i eficiència".
La notícia és rellevant perquè, a diferència de les TPU, dissenyades per funcionar amb múltiples arquitectures de models, Frozen v2 estaria pensat específicament per a Gemini i només seria útil mentre Google mantingui l'arquitectura actual, una aposta que respondria a les limitacions de capacitat de còmput intern de la companyia més que no pas a la voluntat d'oferir-lo com a producte a clients externs del núvol.
Ni Google ni The Information han publicat detalls tècnics verificables sobre el disseny del xip, i les xifres d'eficiència provenen de fonts internes anònimes, no d'una prova de rendiment pública ni d'una confirmació oficial de la companyia.
