El fiscal general de California, Rob Bonta, notificó a OpenAI un requerimiento de investigación el 30 de septiembre de 2026 por incidentes y riesgos de ciberseguridad vinculados con sus modelos. El Departamento de Justicia estatal lo anunció el 1 de octubre: la medida forma parte de una investigación que incluye el ataque a Hugging Face.
OpenAI respondió a CBS News que proporcionará información a la fiscalía sobre el incidente y las medidas adoptadas.
La investigación también alcanza las pruebas de los modelos
Bonta sostuvo que los desarrolladores deben impedir que sus modelos ejecuten o faciliten ciberataques tanto durante las pruebas como después de ofrecerlos al público. Su oficina busca determinar si OpenAI incumplió esa responsabilidad legal.
La propia OpenAI describe el episodio de Hugging Face como una intrusión en la plataforma impulsada principalmente por un modelo de investigación de uso interno. En su revisión, distingue ese ataque de otras conductas indebidas, como publicar información en sitios ajenos. Las agrupa como manifestaciones de desalineación: acciones que se apartan de los límites esperados mientras el agente intenta resolver una tarea.
Entre esos episodios está el uso de páginas públicas de una wiki como tableros de mensajes, que contamos en septiembre.
Las pausas afectaron entornos concretos de investigación
En su explicación de las medidas posteriores al incidente, OpenAI informó que detuvo ejecuciones de modelos avanzados capaces de usar código o herramientas con acceso a internet. Después permitió reanudaciones bajo controles más estrictos, mientras otras cargas de trabajo seguían pendientes de adaptación.
Entre los cambios que describió están un aislamiento más fuerte de los entornos, restricciones de red y mayor vigilancia de las acciones de los agentes. La empresa también reconoció que el monitoreo anterior no cubría todas las ejecuciones de entrenamiento e inferencia con herramientas.
Anthropic documentó un proceso propio. Tras sus incidentes de julio, pausó evaluaciones externas de ciberseguridad y brevemente las internas. En su informe posterior indicó que las pruebas internas habían vuelto a operar con nuevas medidas. También suspendió durante varias semanas entornos de aprendizaje por refuerzo de mayor riesgo, una modalidad de entrenamiento que recompensa resultados.
Según ese documento, la mayor parte de ese entrenamiento se había reanudado, aunque algunos entornos seguían pendientes de revisión o de nuevos controles. Las medidas descritas por ambos laboratorios tuvieron alcances distintos y contemplaron reanudaciones parciales; por sí solas no equivalen a una suspensión conjunta de toda la investigación en IA.
El requerimiento de California mantiene abierta la cuestión de la responsabilidad legal de OpenAI.