La competència entre grans laboratoris d'intel·ligència artificial s'ha desplaçat en els últims mesos cap a la capacitat dels models de mantenir tasques llargues i complexes -escriure codi, navegar per aplicacions, verificar el seu propi treball- sense perdre coherència, més que cap a un simple augment de coneixements generals.
xAI, que ara es presenta sota la marca SpaceXAI, ha llançat Grok 4.6 el 12 d'agost, disponible el mateix dia a Cursor, Grok Build i la seva API, amb socis com OpenRouter, Vercel i Cloudflare. Segons la companyia, el model destaca en agents de llarga durada i en treball visual i interactiu ambiciós, amb capacitat d'autoverificar-se durant l'execució. En els indicadors interns, Grok 4.6 supera Grok 4.5 en proves com GDPVal-AA (1.753 punts davant de 1.526) o DeepSWE (65,9% davant de 54%), i completa les tasques d'agent d'Artificial Analysis amb aproximadament la meitat dels passos.
El model iguala GPT-5.6 Sol en l'índex d'intel·ligència d'Artificial Analysis, amb una puntuació de 61, i es manté al mateix preu que la versió anterior: 2 dòlars per milió de tokens d'entrada i 6 per milió de sortida, amb una variant més ràpida al doble de preu. La companyia ho presenta com un avenç de rendiment sense pujada de preu, en un moment en què els laboratoris rivals compten cada setmana amb un nou llançament.
Les xifres de rendiment provenen de proves internes de la companyia i d'Artificial Analysis, sense que hi hagi encara una avaluació independent més àmplia; tampoc es concreta si el canvi de marca a SpaceXAI implica una integració operativa més profunda amb SpaceX més enllà del nom.