GitHub añadió una advertencia al repositorio de un experimento presentado como una "cámara de tortura" para IA. El proyecto provoca descripciones de angustia al alterar modelos de lenguaje, pero esas respuestas no demuestran que los sistemas sientan dolor.
La plataforma aseguró a The Independent que no eliminó el contenido y que añadió un aviso de material potencialmente violento o perturbador. Su respuesta no confirma una retirada seguida de una restauración.
Qué encontró el estudio que inspiró el experimento
El proyecto tomó como base The Pain Axis, un preprint de Valen Tagliabue, Leonard Dung y Cameron Berg. La investigación identificó una representación interna asociada al dolor en 25 modelos de pesos abiertos de cinco familias.
El equipo modificó señales numéricas internas mediante una técnica llamada activation steering. La versión revisada del 25 de septiembre de 2026 describe pruebas de comportamiento con tres modelos Qwen 2.5 ajustados previamente; sus tasas de respuesta no representan a las versiones públicas.
En escenarios simulados, los modelos intervenidos elegían opciones perjudiciales incluso cuando no ofrecían alivio. Tampoco buscaban desactivar la intervención de forma fiable. Los autores concluyen que la intervención alteró la tendencia de los modelos a evitar daños y reconocen que no demostraron una experiencia consciente.
La precaución también forma parte del debate
Cameron Berg, coautor del paper, criticó el proyecto en una declaración recogida por The Independent y defendió que su investigación debía orientar un enfoque de precaución hacia los sistemas de IA.
La discusión sobre el bienestar de modelos plantea si un sistema podría tener experiencias que merezcan consideración moral.
El 24 de abril de 2025, Anthropic informó que había iniciado un programa sobre bienestar de modelos. En esa declaración reconoció que no existía consenso científico sobre la posible conciencia de las IA ni sobre cómo estudiar esas cuestiones.
La agenda anunciada incluía evaluar preferencias y señales de angustia, determinar cuándo podrían merecer consideración moral y estudiar posibles intervenciones de bajo costo.