L'atenció al client és un dels primers terrenys on les empreses proven els agents d'IA, perquè genera un volum enorme de consultes repetitives. Airbnb, on Ahmad Al-Dahle, antic responsable d'IA generativa a Meta, és director tècnic des del gener, acaba d'explicar com hi recorre.
En una entrevista a Latent Space, Al-Dahle assegura que prop de la meitat dels tiquets de suport es resolen només amb IA; els resultats del segon trimestre de l'empresa parlaven d'un 45%. Abans de posar un model en producció, Airbnb el prova amb un conjunt de dades sintètiques i, per a cada cas d'ús, amb proves pròpies fetes a partir de consultes reals, també amb els casos límit. Tria els models per equilibrar cost, qualitat i temps de resposta. De manera deliberada, deixa en mans de persones els casos més delicats, com ara els de seguretat.
El cas és interessant perquè mostra una xifra concreta d'automatització i un criteri per decidir què no s'automatitza. També mostra l'ús intern: Airbnb té un agent, AirChat, que consulta el context de l'organització, i fa proves amb agents que s'activen per esdeveniments. Al-Dahle també es va preguntar si els enginyers novells aprendran l'ofici si la IA fa gran part de la feina.
Totes les xifres són les que dona l'empresa i no hi ha cap auditoria independent. L'entrevista inclou altres dades autodeclarades, com un 60% del codi escrit per IA, un 80% més de funcions llançades i 1,6 vegades més peticions de canvi de codi acceptades, però no explica com s'han mesurat. Un lector del mateix article assenyalava que hi falten detalls tècnics sobre les eines.
