Nvidia és, sobretot, l'empresa que ven els xips amb què s'entrenen i s'executen els grans models d'IA d'OpenAI, Google o Anthropic, no una fabricant de models pròpia de primera línia. Fins ara, la seva família Nemotron havia quedat en un segon pla darrere dels llançaments dels grans laboratoris, tot i que Jensen Huang s'havia sumat als seus col·legues del sector a demanar al govern nord-americà que no posés traves als models de pesos oberts.
L'11 d'agost, Nvidia va presentar Nemotron 3.5 Lightning, un model de 30.000 milions de paràmetres amb arquitectura de mescla d'experts -només 3.000 milions de paràmetres actius per cada token processat-, publicat en obert i disponible gratuïtament per a ús comercial a Hugging Face, ModelScope, OpenRouter i com a microservei NIM al mateix build.nvidia.com, sense necessitat de demanar permisos ni pagar llicència. Segons Nvidia, el model ofereix fins a quatre vegades més velocitat de resposta i completa tasques d'agent un 30% més ràpid que altres models de la seva categoria, mantenint una precisió d'alt nivell mentre redueix el cost de completar tasques a gairebé una tercera part del d'Opus 4.8 tot sol, segons les seves pròpies proves. Nvidia també ha publicat en obert NeMo Switchyard, una llibreria que encamina automàticament cada petició cap al model més adequat dins d'eines d'agents populars.
El llançament està pensat per a agents especialitzats que han d'estar operatius de manera constant en tasques concretes i repetitives -revisió de codi, ús d'eines, vigilància de seguretat o consultes de facturació-, en lloc de competir directament amb els grans models generalistes de conversa. És el primer model obert que Nvidia treu sota l'actual etapa de lideratge de Huang, i arriba en un moment en què cada cop més empreses busquen alternatives obertes i més barates als grans models tancats per rebaixar el cost d'operar agents a gran escala, un debat que aquest mateix diari ha anat seguint amb llançaments similars de Meta o DeepSeek.
Les xifres de velocitat i cost que dona Nvidia provenen de les seves pròpies proves internes, no d'una avaluació independent, i la comparació amb Opus 4.8 és només un dels múltiples punts de referència possibles. Nemotron 3.5 Lightning està optimitzat per a tasques especialitzades i no pretén substituir els grans models generalistes en converses complexes o de coneixement ampli.