L'equip Qwen d'Alibaba ha publicat el 14 d'agost els pesos oberts de dos models nous: Qwen3.8-27B, el model principal amb 27.000 milions de paràmetres, i una variant més gran, Qwen3.8-2.4T-A95B. Tots dos es distribueixen sota llicència Apache 2.0, la mateixa que l'equip ha fet servir en llançaments anteriors de la família Qwen, i ja estan disponibles a Hugging Face i ModelScope.
Qwen3.8-27B és un model dens i multimodal: accepta text, imatges i vídeos de diverses hores de durada, inclosos diagrames i documents, i incorpora una finestra de context nativa de 262.000 tokens que es pot ampliar fins a un milió amb el mètode YaRN. Segons The Decoder, el model supera el seu germà més gran, Qwen3.7-Plus, en tasques de programació i d'ofimàtica, i incorpora capacitats d'agent millorades: planifica les tasques de manera més autònoma i les completa amb més fiabilitat. Diverses proves independents citades pel mitjà situen el seu rendiment en 206 tokens per segon sobre una sola targeta gràfica RTX 5090 mitjançant SGLang, amb integració des del primer dia amb vLLM capaç d'arribar a un milió de tokens de context en una sola GPU.
La rellevància del llançament és que continua la tendència, liderada per laboratoris xinesos com Alibaba, DeepSeek o Z.ai, de publicar models d'alt rendiment en obert i de mida prou reduïda per córrer en maquinari de consum, en comptes de reservar les capacitats més avançades a API tancades. Un model que cap en una sola targeta gràfica domèstica i que gestiona context d'un milió de tokens redueix significativament la barrera d'entrada per a desenvolupadors i petites empreses que vulguin experimentar amb agents d'IA multimodals sense dependre d'un proveïdor de núvol.
Les xifres de rendiment provenen en bona part de proves fetes per tercers i de les pròpies notes tècniques de l'equip Qwen, no d'una avaluació independent centralitzada, de manera que caldrà veure com es comporta el model en bancs de proves estandarditzats i en un ús real prolongat. Alibaba també ha anunciat una versió allotjada amb capacitat d'un milió de tokens a través de Qwen Cloud, encara sense data de disponibilitat general.