Ahir vam explicar que Reflection AI, la startup que finança Nvidia, preparava el primer model obert occidental capaç de competir amb DeepSeek i Qwen. Ara ja l'ha presentat: es diu Beam i té 501.000 milions de paràmetres, segons que ha explicat l'empresa el 5 d'octubre. Els fundadors són Misha Laskin i Ioannis Antonoglou, i la companyia ja havia aixecat fons amb una valoració de 25.000 milions de dòlars.
Per ara Beam només és accessible en un programa d'accés anticipat. Els pesos del model, la documentació i les eines per ajustar-lo s'han de publicar més endavant aquest mes d'octubre. Reflection explica que el model base va costar menys de quatre setmanes d'entrenament amb 6.144 targetes gràfiques d'Nvidia i 23,8 bilions de fragments de text (*tokens*) del web públic i de fonts comercials. La fase d'aprenentatge per reforç, centrada en programació, cerca a la xarxa i agents, es va fer en entorns simulats aïllats, uns 1.300 milions, durant quatre setmanes més.
L'empresa assegura que Beam fa algunes tasques millor que GLM-5.2, un model xinès de 751.000 milions de paràmetres, amb una tercera o una quarta part del maquinari, i que s'acosta al rendiment de Qwen 3.8-Max, que en té més de dos bilions. La lectura que en fa el sector és clara: els models oberts més potents venen de la Xina, i aquest seria un primer intent seriós de contrarestar-ho des dels Estats Units. El clúster d'entrenament, de 10.000 targetes GB300, es va llogar en un acord de 6.300 milions de dòlars.
Cal ser prudents: les comparacions són de l'empresa i encara no s'han pogut contrastar de manera independent, perquè el model no és públic. SiliconANGLE també recorda que els models gratuïts continuen per sota dels models capdavanters, com el Claude Fable 5.1 d'Anthropic. Tampoc no se sap encara quina llicència tindrà el codi ni en quines condicions es podrà fer servir comercialment.
