Christopher Olah, cofundador de Anthropic, lleva tiempo impulsando un debate acerca de la posibilidad de que la IA pueda tener conciencia.
Anthropic publicó un documento de 84 páginas –conocido internamente como la Constitución de Claude— en el que se describe «el tipo de entidad que nos gustaría que fuera Claude» y «los valores que nos gustaría que encarnara». En ese contexto, Olah plantea diversas cuestiones: ¿Cómo se les ayuda a madurar? ¿Cómo se les ayuda a ser profundamente morales?».
Altos cargos de Anthropic, con Olah al frente, se reunieron desde el otoño de 2025 con líderes religiosos de distintas confesiones para explorar cómo educar moralmente a Claude y debatir la posible conciencia o el eventual estatus moral de los sistemas de IA.
En una de esas reuniones, Olah se mostró especialmente interesado cuando un participante planteó que los modelos pudieran «confesarse», de manera análoga al sacramento católico de la confesión. Según un rabino presente, «el Sr. Olah vio valor no solo en que un modelo alertara cuando había hecho algo malo, sino también en cómo el acto de la confesión podía moldear la percepción que el modelo tenía de sí mismo y, por tanto, sus decisiones».
Conclusión
Christopher Olah estuvo presente y tomó la palabra cuando el papa León XIV presentó la encíclica Magnifica Humanitas. El pontífice dejó claro que la IA no tiene conciencia, ni cuerpo, ni experiencias subjetivas, ni conciencia moral, una idea que, al parecer, resultó incómoda para Olah.
La cuestión decisiva no es si una IA puede simular comportamientos asociados a la reflexión moral, la culpa o el arrepentimiento, sino si existe alguna evidencia de que experimente subjetivamente esos estados, y hasta ahora no la hay.


