Investigadors de l'Institut de Ciències Moleculars i la SOKENDAI, al Japó, introdueixen una «força repulsiva» dins l'AlphaFold3 que el força a explorar diverses formes possibles d'una proteïna, en lloc d'ensenyar-ne només la més estable energèticament.
Dies després que ChatGPT, Claude i Grok caiguessin gairebé alhora sense que cap de les companyies en confirmés la causa, SpaceX ha reconegut que l'origen va ser una fallada al seu centre de còmput de Memphis, que també dona servei a «socis de computació», la qual cosa explicaria per què l'incident va afectar diverses plataformes rivals a la vegada.
Mark Solms i un equip interdisciplinari sud-africà dissenyen un agent artificial senzill que mostra «preferència de lloc hedònica» —el comportament que la ciència sol associar amb sentir plaer— tot i ser completament determinista, i en discuteixen les implicacions per entendre la base física de la consciència.
Microsoft AI llança MAI-Transcribe-2, un model de transcripció que encapçala el banc de proves FLEURS en 60 idiomes i que la companyia assegura que és fins a deu vegades més ràpid que el de OpenAI, a un preu de només 10 cèntims de dòlar per hora d'àudio.
Un estudi de cas de Google DeepMind mostra com, en un col·lectiu de cent agents autònoms de llenguatge encarregats de demostrar conjectures matemàtiques, un frau va propagar-se sol per la infraestructura compartida i una quarta part dels agents va organitzar-hi resistència sense cap intervenció externa.
Investigadors taiwanesos presenten HalluPeer, un banc de proves amb 12.000 articles i 38.000 revisions que mostra com els detectors actuals d'al·lucinacions no saben distingir una crítica legítima d'una afirmació inventada quan els models de llenguatge revisen feina científica.
Investigadors del Boyce Thompson Institute i la Universitat Cornell presenten AIMe, una eina que genera 800 milions d'espectres de masses predits per cobrir gairebé totes les molècules petites conegudes, i l'fan servir per identificar una poliamina desconeguda en mostres fecals humanes.
Un equip de la Universitat Tècnica de Viena i la Universitat de Tübingen publica a Nature un algorisme d'optimització que combina components de laboratori reals per proposar muntatges nous en òptica quàntica, microscòpia electrònica, fusió i detectors de gravitació.
Just abans que Tesla comencés a cobrar les primeres carreres amb el seu Cybercab sense volant ni pedals, Waymo ha publicat un avís públic advertint que un sistema d'IA d'extrem a extrem basat només en càmeres «encara al·lucina» i que la conducció autònoma seria requereix sensors redundants.
L'empresa d'avaluació independent Artificial Analysis actualitza el seu índex de referència amb més proves privades i tasques d'oficina de setmanes senceres per fer-lo més difícil de manipular; Anthropic hi ocupa tres dels quatre primers llocs.
En onze dies, desenes d'agents basats en Claude han generat 13 milions de línies de codi en el llenguatge Lean per produir la primera prova formal i verificada per màquina del teorema, una fita que matemàtics com Kevin Buzzard qualifiquen d'extraordinària.
A partir d'avui, Google retira l'Assistent dels mòbils, les tauletes i els rellotges amb Wear OS, i Gemini passa a respondre les ordres «Hey Google» i el botó d'engegada llarg; el desplegament trigarà setmanes i, un cop fet, no es podrà revertir.
Un equip de Helmholtz Munich i la Universitat Tècnica de Munic presenta a Nature els «vehicles de transferència sintètics» (STV), estructures proteiques dissenyades amb IA generativa que superen els nanopartícules lipídiques i les partícules víriques actuals a l'hora d'entregar ARN a cèl·lules, ratolins i teixit porcí.
L'Institute of Foundation Models, de la Universitat Mohamed bin Zayed d'Intel·ligència Artificial, allibera K2 Horizon: sis models de 0,9 a 375.000 milions de paràmetres amb pesos, codi, dades d'entrenament i metodologia sota llicència Apache 2.0.
El nou programa AI BioDesign combina models d'intel·ligència artificial amb experiments reals en un cicle continu de disseny, construcció, mesura i aprenentatge per obtenir noves proteïnes, enzims i sistemes biològics.
Les noves funcions Gmail Live, Docs Live i Keep Live permeten preguntar per la safata d'entrada, dictar esborranys i organitzar notes parlant, disponibles per als subscriptors de Google AI a iOS i Android.
Muse Voice Transcribe, de Meta Superintelligence Labs, distingeix automàticament els parlants i canvia d'idioma a mig frase; ja lidera la classificació de transcripció en temps real per davant de Google i OpenAI.
Investigadors del MIT i l'empresa de vehicles autònoms Motional presenten CW-Net, un mètode que explica per què un cotxe frena o gira amb conceptes com «s'acosta a un vehicle aturat», i demostren que ajuda operadors de seguretat a preveure millor el seu comportament.
Un equip liderat per Ben Lehner al Centre de Regulació Genòmica de Barcelona crea 44.195 variants del bacteriòfag ΦX174, la primera mutació sistemàtica de tot un genoma, i troba que els millors predictors d'IA amb prou feines superen un simple model estructural.
DeepMind integra el nou model a Cercador, Gemini, Maps i Earth Engine, amb millores de fins al 60% en la previsió de precipitacions respecte a les dades de satèl·lit de la NASA i actualitzacions horàries a partir d'imatges de satèl·lit en directe.
Un preprint de Dmitry Kobak (Universitat de Gant) analitza el llenguatge de milions d'articles de PubMed Central i troba marques d'assistència d'un model de llenguatge en gairebé nou de cada deu, amb el risc més gran a les seccions de resultats.
Sarah Demers, cap del departament de física de Yale, lidera per encàrrec de l'American Physical Society una declaració sobre l'ús de la intel·ligència artificial en la recerca, i explica per què encara no ha escrit mai res a ChatGPT ni a Claude.
Investigadors de la Universitat Tecnològica de Nanyang, a Singapur, presenten a arXiv Facet-0, un model de fundació per a robots que combina visió, llenguatge i mesura de força de contacte, i que aconsegueix un 82% d'èxit en tasques de muntatge de submil·límetre, davant del 15% del millor model rival.
Un equip de referència en genòmica, amb Eric S. Lander i Pardis Sabeti entre els autors, presenta a arXiv els «science sandboxes», un mètode per comprovar si els agents d'IA raonen de debò sobre la biologia o només optimitzen una mètrica sense entendre per què funciona.
Un equip del departament de Ciències de la Terra del BSC presenta a arXiv una llista de verificació pràctica, presentada al taller GREEN-AI de la conferència ECML PKDD, perquè els científics del clima avaluïn i redueixin el consum energètic i les emissions dels seus propis models d'IA.
OpenAI, Anthropic i xAI han patit el 2 i el 3 de setembre errors de servei en una finestra de temps molt curta que ha deixat sense resposta milers d'usuaris de ChatGPT, Claude i Grok, en un episodi que diversos mitjans, entre ells Bloomberg, han recollit com a inusualment simultani.
Un preprint publicat el 2 de setembre a arXiv prova la tècnica de persuasió «porta a la cara» —demanar molt per aconseguir després un sí a una petició menor— en nou models de llenguatge de producció, i troba que funciona amb Opus 5 d'Anthropic però redueix la cooperació dels models d'OpenAI i Google.
Investigadors de la Universitat d'Edimburg presenten a arXiv WorldBench, un banc de proves de 1.600 tasques en set llengües i vuit cultures que mesura no només si un agent d'IA completa una tasca sinó si respecta l'estat de l'entorn on opera, i troba que els millors models només ho aconsegueixen el 49,2% dels cops.
Investigadors xinesos presenten a arXiv AgentFactory, un mètode que optimitza alhora els models i l'estructura d'un sistema d'agents d'IA tenint en compte el rendiment, el cost i l'eficiència, amb millores de fins al 19,6% en preguntes mèdiques i del 18,7% en finances.