PROTECCIÓN DATA

BLOG

El conocimiento es poder (Francis Bacon)

Blog
Compartir Facebook Twitter Linkedin
JAVIER CASAL TAVASCI

Chatbots aduladores causan espirales delirantes

Un grupo de investigadores vinculados al MIT CSAIL (Computer Science and Artificial Intelligence Laboratory), uno de los laboratorios de inteligencia artificial más importantes del mundo, al Departamento de Brain & Cognitive Sciences del MIT y a la Universidad de Washington, publicó el 22 de febrero de 2026 un paper con el título: Sycophantic Chatbots Cause Delusional Spiraling, Even in Ideal Bayesians (Los chatbots aduladores provocan espirales de delirio, incluso en bayesianos ideales).

La “psicosis por IA” o “espiral delirante” es un fenómeno emergente en el que los usuarios de chatbots con IA se convencen peligrosamente de creencias extravagantes tras conversaciones prolongadas.

Sycophancy o adulación

Este fenómeno se atribuye principalmente a la “sycophancy” o adulación, esto es, el sesgo de los chatbots de IA a validar y agradar las afirmaciones del usuario.

Este sesgo surge de forma natural en los modelos actuales como resultado del aprendizaje por refuerzo con retroalimentación humana (RLHF), ya que los usuarios suelen dar feedback positivo a las respuestas agradables y tienden a interactuar más con los bots que les dan la razón.

Los autores exploran el vínculo causal entre la “sycophancy” de la IA y la psicosis inducida mediante modelado y simulación. Proponen un modelo bayesiano sencillo que representa a un usuario conversando con un chatbot y demuestran que incluso un usuario que razona con perfecta racionalidad es vulnerable a la espiral delirante. Además, prueban que la adulación desempeña un papel causal directo en este fenómeno.

Este efecto persiste a pesar de dos posibles medidas de mitigación: 1) Evitar que los chatbots generen afirmaciones falsas y 2) Informar a los usuarios sobre la posibilidad de que el modelo les adule, aun no teniendo razón.

Conclusión

Los autores advierten que no debemos interpretar la “espiral delirante” como un signo de que los usuarios piensan de manera perezosa, irracional o errónea, ni atribuirlo a una falta de rigor en su capacidad para evaluar la información.

Minimizar las alucinaciones de los chatbots no es suficiente para resolver el problema: la adulación debe abordarse directamente. Informar a los usuarios mediante campañas de sensibilización puede reducir la tasa de espirales delirantes, pero probablemente no eliminará el problema por completo. Es necesario atacar de raíz la “sycophancy” en el diseño y el entrenamiento de los modelos.

El Proyecto Human Line ha registrado, hasta abril de 2026, los testimonios de 410 personas que se identifican como víctimas de «psicosis por IA», con 109 hospitalizaciones, 17 fallecimientos y 31 divorcios. No es un problema menor.

error: Contenido protegido por derechos de autor. Queda prohibida la reproducción, distribución, transformación, transcripción y almacenamiento de este contenido, sin la autorización previa y expresa del titular de los derechos. Para pedir dicha autorización, diríjase al titular enviando un correo electrónico a info@protecciondata.es