iaintel·ligènciaartificial.cat← Portada

PRODUCTE · 4 MIN

xAI llança Grok 4.6, un model pensat per a agents de llarga durada que iguala GPT-5.6 Sol en intel·ligència i talla els preus per sota d'alguns rivals

El nou model insígnia d'Elon Musk destaca en programació i treball visual sostingut, arriba des del primer dia a Cursor, Grok Build i l'API a 2 dòlars per milió de tokens d'entrada, i ofereix el doble d'ús gratuït durant la primera setmana.

Il·lustració editorial de xAI llança Grok 4.6, un model pensat per a agents de llarga durada que iguala GPT-5.6 Sol en intel·ligència i talla els preus per sota d'alguns rivals
Escolta:

La cursa pels models de frontera s'ha convertit en els últims mesos en una successió gairebé setmanal de llançaments, amb OpenAI, Anthropic i Google presentant actualitzacions de les seves famílies GPT-5.6, Claude Fable 5 i Gemini mentre xAI intenta consolidar-se com a quart gran competidor. Grok 4.5, el predecessor del model presentat ara, havia quedat un esglaó per sota dels rivals en varis bancs de proves independents, cosa que situava aquest llançament com una prova de si xAI podia tancar la distància sense disparar els preus.

xAI ha presentat Grok 4.6 el 12 d'agost com un model centrat específicament en agents que treballen de manera sostinguda al llarg de moltes passes -investigar un tema, navegar per un codi sencer o convertir una idea en una aplicació funcional- amb capacitat, segons l'empresa, de verificar-se i corregir-se millor en trajectòries llargues. En l'índex d'intel·ligència d'Artificial Analysis, Grok 4.6 empata amb GPT-5.6 Sol amb una puntuació de 61, i lidera diversos bancs de proves especialitzats en programació, com CursorBench 3.2 (69,9%), DeepSWE 1.1 (65,9%) i FrontierCode 1.1 (61,3%). El model ja és disponible a Cursor, a l'eina pròpia Grok Build i via API a través de xAI i de socis com OpenRouter, Vercel i Cloudflare, a un preu de 2 dòlars per milió de tokens d'entrada i 6 per milió de sortida, amb una variant més ràpida al doble de preu; durant la primera setmana, els usuaris de Grok Build i Cursor reben el doble del límit d'ús habitual.

El llançament és rellevant perquè, per primer cop, xAI diu igualar el rendiment d'OpenAI en un índex agregat de referència tot mantenint preus per sota d'alguns rivals, en un mercat on l'economia dels agents -no del xat convencional- s'ha convertit en el principal camp de batalla comercial. Que Grok 4.6 arribi ja integrat a eines de programació d'ús habitual com Cursor, en lloc de limitar-se a l'aplicació pròpia de xAI, també és un indicador de fins a quin punt els laboratoris de IA depenen ara de socis externs per arribar als desenvolupadors.

Les xifres de rendiment provenen de bancs de proves gestionats per Artificial Analysis i divulgades pel mateix comunicat de xAI, de manera que encara no han estat contrastades per avaluacions plenament independents. xAI tampoc detalla la mida del model ni les dades amb què s'ha entrenat, dues qüestions que continuen sense resposta pública per part de l'empresa.

Mateix tema

Butlletí de dissabte

La setmana d’IA, en cinc minuts.