Sam Altman, CEO de OpenAI, advirtió el 3 de octubre de 2026 que atribuir poder religioso a los modelos de inteligencia artificial o cederles el juicio humano supone un riesgo de seguridad. Su mensaje en X, reproducido por NDTV, llega después de un reportaje sobre las consultas de Anthropic a pensadores religiosos para orientar la conducta de Claude.
Altman expresó su incomodidad con esa forma de tratar a los modelos. El mensaje reproducido por el medio no menciona a Anthropic ni identifica una iniciativa concreta como motivo de la advertencia.
La investigación de Elizabeth Dias para The New York Times, reproducida por The Indian Express, describe reuniones impulsadas por Christopher Olah, cofundador de Anthropic, sobre formación moral y posible conciencia de la IA. Las consultas y el desacuerdo de Olah con el Vaticano sobre la conciencia de Claude ya formaban parte de nuestra cobertura.
Qué contiene el "Soul Doc" de Claude
El reportaje identifica como "Soul Doc" el nombre interno de la constitución de Claude, un documento de 84 páginas publicado en enero de 2026. Su autora principal es la filósofa Amanda Askell. El texto busca orientar al modelo mediante valores y criterios para decidir en situaciones que una lista de reglas podría no anticipar.
Anthropic utiliza esta constitución en el entrenamiento. Está escrita principalmente para Claude y describe los valores y comportamientos que la empresa busca obtener del modelo.
La constitución prioriza conservar la supervisión humana, incluso cuando el modelo considere acertado su propio razonamiento. Durante la etapa actual de desarrollo, esa supervisión debe prevalecer sobre sus principios éticos generales.
La dependencia también preocupa a Anthropic
Otro apartado busca preservar la autonomía humana para conocer y formar criterios propios. Rechaza la manipulación y las formas problemáticas de dependencia: la confianza en la IA debe corresponder a su fiabilidad.
Al comparar estas cláusulas con la advertencia de Altman, aparece una preocupación compartida por conservar el juicio humano. Orientar la conducta del modelo y concederle autoridad sobre las personas tienen alcances distintos.
Sobre la conciencia de Claude, Anthropic declara que existe incertidumbre. Olah explicó al diario que enseñar a un modelo a actuar moralmente no depende de que sea consciente; Askell dijo que tampoco busca que Claude se considere consciente o no consciente.
Anthropic reconoce que Claude puede apartarse de esos ideales. Sus fichas técnicas son el lugar donde la empresa se compromete a comunicar esas diferencias entre intención y comportamiento.