OpenAI va llançar la família de models GPT-5.6 fa poc més de tres setmanes, en un mercat on la competència de models xinesos de codi obert, molt més barats, pressiona les grans tecnològiques nord-americanes a abaratir els seus propis serveis per a clients empresarials.
La companyia va anunciar aquest 30 de juliol una retallada de preus per a les dues versions més econòmiques de GPT-5.6: Luna baixa un 80%, de l'1 dòlar per milió de tokens d'entrada i 6 dòlars de sortida als 20 cèntims i 1,20 dòlars respectivament, mentre que Terra baixa un 20%, dels 2,50 i 15 dòlars anteriors als 2 i 12 dòlars per milió de tokens. El preu de Sol, el model més potent de la família, es manté igual, tot i que hi estrena un "mode ràpid" que ofereix respostes fins a 2,5 vegades més ràpides al doble de tarifa. OpenAI atribueix la baixada a "optimitzacions integrals en tota la pila de programari", com ara millores en l'encaminament de maquinari, el programari d'inferència i els algoritmes de memòria cau de context, i afirma que el mateix model Sol va reescriure de manera autònoma kernels de programari de producció crítics, cosa que hauria reduït un 20% el cost de servir el model i millorat més d'un 15% l'eficiència de generació de tokens.
La notícia és rellevant perquè mostra com la pressió de preus dels models xinesos de codi obert ja obliga OpenAI a abaratir els seus productes empresarials només tres setmanes després de llançar-los, i perquè la companyia atribueix part de l'estalvi a un ús del seu propi model per optimitzar la infraestructura que l'executa.
OpenAI no ha xifrat quin percentatge exacte de l'estalvi de costos prové de les millores de maquinari enfront de les optimitzacions fetes pel mateix model, ni ha precisat quant de temps mantindrà aquests preus si la pressió competitiva dels models xinesos continua intensificant-se.