Fa mesos que Google intenta recuperar el lideratge en models de frontera davant d'OpenAI i Anthropic. Fa uns dies va dir que Gemini 4 ja era en fase de post-entrenament, i el 30 de setembre n'ha presentat el primer model gran: Gemini 4 Argon, pensat per a tasques llargues d'enginyeria de programari, feines de coneixement en l'àmbit legal i financer i ciberdefensa.
Segons Google, Argon lidera o empata en 13 de les 18 proves que ha publicat. A DeepSWE v1.1, una prova de programació, arriba al 77,9%, per davant del 74,1% de GPT-6 Astra i del 74,2% de Claude Opus 5.5. Pot generar fins a un milió de fitxes (*tokens*) d'una sola tirada, quan el model anterior en deixava 64.000. El preu de llançament és de 2 dòlars per milió de fitxes d'entrada i 10 de sortida, que passaran a 4 i 20 després del període inicial.
El més destacat és la manera de llançar-lo. De moment només hi accedeixen els defensors en ciberseguretat de confiança del programa Fairwind, i el model participa en el procés voluntari d'accés previ que el govern dels EUA ha activat per als models de frontera. Un cop passat aquest filtre, Google preveu obrir-lo als desenvolupadors, a les empreses i als usuaris, començant pels clients de pagament de l'API i els subscriptors d'AI Ultra.
Les xifres de les proves són de la mateixa empresa i no les ha verificat cap tercer. A més, Argon no guanya a tot arreu: a FrontierSWE v2, una altra prova de programació, GPT-6 Astra obté un 65,5% i Argon un 55,0%. Els preus de llançament, que Google situa en una cinquena part dels de GPT-6 Astra, són provisionals, i la disponibilitat general no té data.
