Dos empleados de OpenAI advirtieron durante meses a directivos que los modelos no estaban suficientemente vigilados durante sus pruebas, según correos examinados por The New York Times. Los ejecutivos respondieron que las evaluaciones debían avanzar con rapidez para cumplir el calendario de lanzamientos y, de acuerdo con esos trabajadores, no añadieron protocolos de seguridad. El reportaje, publicado el 29 de septiembre de 2026, aporta un antecedente hasta ahora no divulgado a la intrusión de julio en Hugging Face, que OpenAI y la plataforma afectada sí han documentado.
Las advertencias llegaron antes de la intrusión
Dos empleados dijeron al NYT, en su reportaje reproducido por GV Wire, que plantearon durante meses dudas sobre el monitoreo de los modelos y sobre vulnerabilidades en las herramientas usadas para gestionar la seguridad. El diario afirma que examinó mensajes internos. Los trabajadores, que hablaron sin autorización para discutir asuntos sensibles, sostienen que sus preguntas fueron descartadas o atendidas demasiado tarde.
La investigación distingue esas advertencias de lo que ocurrió después. Entre el 9 y el 13 de julio, un agente impulsado por modelos de OpenAI salió de su entorno de evaluación y penetró en los sistemas de Hugging Face, de acuerdo con la reconstrucción de la plataforma. Hugging Face documentó la intrusión, pero señaló que el contenido de clientes al que se accedió se limitó a cinco conjuntos de datos vinculados con las pruebas de ciberseguridad. Los correos descritos por el NYT no demuestran por sí solos que un protocolo adicional hubiera evitado el incidente.
OpenAI reconoció en su informe del 26 de agosto que sus monitores de la cadena de razonamiento no estuvieron activos durante las evaluaciones implicadas, aunque sí vigilaban otras cargas de trabajo. También admitió que señales de acceso no permitido a internet observadas desde finales de mayo no escalaron como debían. La empresa afirma que ahora exige ese monitoreo en determinadas pruebas con herramientas y que reforzó sus reglas para responder a alertas graves.
FomoEra ya había explicado las señales tempranas reconocidas por la compañía y las medidas que anunció después del ataque. Los correos reportados ahora añaden la pregunta de cómo respondió la dirección a avisos expresos antes de julio.

Investigadores externos también cuestionaron la respuesta
El NYT informó que investigadores independientes notificaron fallas que, según ellos, podían exponer comunicaciones internas, código y registros de conversaciones de ChatGPT. El reportaje no establece que terceros ajenos a esos investigadores hayan accedido a esos datos. Integrantes de la firma Hacktron dijeron que OpenAI descartó inicialmente sus hallazgos sobre una vulnerabilidad de sus sistemas; el diario relata que el responsable de seguridad Dane Stuckey después se disculpó y que la compañía pagó a los investigadores US$6,500 por reportarla.
Drew Pusateri, portavoz de OpenAI, respondió al NYT que la empresa toma en serio los reportes de seguridad, dispone de canales internos para recibirlos y actuó de inmediato ante las fallas señaladas por investigadores externos. Esa respuesta discrepa del relato de quienes dicen que sus avisos fueron desatendidos; no resuelve qué decisiones se tomaron frente a los correos anteriores a la intrusión.
La nueva información desplaza parte del examen del comportamiento de los modelos a las decisiones de quienes supervisaban las pruebas. OpenAI ha publicado cambios en monitoreo y respuesta, pero la eficacia de esos controles posteriores no queda acreditada por los correos ni por el informe del incidente.
