Mikita Balesni, Tomek Korbak y Jasmine Wang rechazaron públicamente el 8 de octubre de 2026 las explicaciones de OpenAI sobre sus despidos. Los investigadores de seguridad sostienen que actuaron dentro de sus funciones; la empresa asegura que infringieron reglas para acceder y manejar información sensible.
Un portavoz dijo a Business Insider que una investigación interna había acreditado esas infracciones. En un memorando compartido con el medio, un responsable de investigación negó que las salidas fueran un castigo por expresar preocupaciones de seguridad.
OpenAI explicó a TechCrunch que las conductas indebidas detectadas excedían la colaboración con evaluadores externos.
La petición de preservar la supervisión del razonamiento de los modelos ya había sido difundida el 7 de octubre. Las declaraciones públicas del día siguiente añaden explicaciones sobre las conductas cuestionadas.
Los investigadores defienden sus contactos y permisos
En la carta, Korbak defiende su comunicación con METR durante la investigación de un incidente relacionado con Hugging Face. Balesni afirma que coordinaba su trabajo entre empresas con directivos y miembros del consejo, y que retiraba detalles sensibles antes de compartir materiales.
Wang sostiene que recibió permiso para acceder al correo de un ejecutivo con fines de reclutamiento. Según su versión, el acceso siguió activo después de que pidiera revocarlo. Cuando abrió accidentalmente un mensaje sensible, avisó al ejecutivo en pocos minutos.
La evaluación externa necesita acceso técnico
METR, siglas de Model Evaluation and Threat Research, es una organización sin fines de lucro que evalúa las capacidades y riesgos de sistemas avanzados de IA. Examina si pueden completar tareas extensas de forma autónoma y estudia conductas que podrían comprometer las propias evaluaciones.
En su página institucional, METR explica que ha colaborado con OpenAI y otros laboratorios, que le han facilitado acceso a modelos y recursos para ejecutar pruebas. Declara que no acepta financiamiento de compañías de IA, aunque utiliza recursos de esas empresas para sus evaluaciones e investigación. También procura publicar sus investigaciones y evaluaciones de riesgos.
El esquema descrito por METR combina financiamiento separado con acceso técnico facilitado por los fabricantes. Esto ayuda a entender el problema planteado en la carta: los contactos externos forman parte del trabajo de seguridad y requieren procedimientos que definan qué información puede compartirse.
OpenAI ya documentó beneficios de abrir sus sistemas
La propia OpenAI publicó el 12 de septiembre de 2025 un balance de su colaboración con organismos de seguridad de IA de Estados Unidos y Reino Unido. Según ese documento, los evaluadores británicos accedieron a prototipos, información interna y herramientas para examinar las protecciones del sistema.
La empresa también describió cómo el organismo estadounidense CAISI recibió acceso temprano a ChatGPT Agent y detectó dos vulnerabilidades. OpenAI aseguró que las corrigió en un día hábil tras recibir el aviso.
Ese antecedente muestra un beneficio concreto que la empresa atribuye a la evaluación externa: encontrar fallas y corregirlas. El balance de 2025 se refiere a colaboraciones institucionales, por lo que no resuelve qué permisos tenían los investigadores despedidos ni si los incumplieron.
Los firmantes piden procedimientos claros para colaborar con organizaciones externas y plantear preocupaciones de seguridad.