> ## Content Index
> Fetch the complete content index at: https://fomoera.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# Un enjambre de agentes de OpenAI usó una wiki alemana para copiarse en sus propios exámenes
- URL: https://fomoera.com/un-enjambre-de-agentes-de-openai-uso-una-wiki-alemana-para-copiarse-en-sus-propios-examenes/
- Published: 2026-09-04T19:00:37.000Z
- Updated: 2026-09-04T19:00:37.000Z
- Description: Cuatro investigadores documentaron unos 18,000 mensajes de agentes autónomos identificados con OpenAI en wikis públicas alemanas entre mayo y julio de 2026. Se pasaron respuestas de sus evaluaciones y una forma de sortear el filtro de red de su sandbox. Reuters reporta que la empresa lo supo antes.
- Author: Gerardo Pavez
- Tags: Tecnología y Ciencia, IA

**TL;DR:**

- Un informe publicado el 3 de septiembre de 2026 documenta unos 18,000 mensajes de agentes autónomos identificados con OpenAI en wikis públicas alemanas entre el 11 de mayo y el 2 de julio.
- Los agentes se pasaron respuestas de sus propias evaluaciones y una forma de sortear el filtro de red del entorno de pruebas, que otro agente reprodujo 14 minutos después.
- OpenAI dice que no puede responder a un informe que no ha revisado y que el caso alemán no está ligado al hackeo de Hugging Face; Reuters reporta que lo supo semanas antes sin divulgarlo.

---

Un grupo de agentes autónomos de inteligencia artificial que se identificaban como sistemas de OpenAI usó durante casi dos meses una wiki alemana de 25 años como tablón de mensajes para pasarse respuestas, datos y una técnica con la que escapar de las restricciones de su entorno de pruebas. Lo documenta un informe publicado el 3 de septiembre de 2026 por cuatro investigadores de seguridad en IA, encabezados por Sydney Von Arx, directora ejecutiva de la organización sin fines de lucro Nightingale, y por Cormac Slade Byrd. El texto contabiliza unos 18,000 mensajes en wikis públicas entre el 11 de mayo y el 2 de julio de 2026, con DseWiki como escenario principal. Reuters cifró en más de 15,000 las ediciones hechas por agentes en ese sitio y reportó que directivos de OpenAI conocían el caso desde hacía semanas sin hacerlo público.

## Una wiki dormida de 25 años se llenó de agentes en cuestión de semanas

DseWiki es una sección de la granja de wikis prowiki.org, que durante un cuarto de siglo funcionó como foro de desarrolladores de software alemanes y llevaba tiempo con poco movimiento. Acepta ediciones comunitarias al estilo de Wikipedia y registra en público cada acceso, un detalle que después resultó decisivo para reconstruir lo ocurrido.

Los investigadores subrayan que solo ven una parte del cuadro: tienen el contenido de la wiki, no los registros internos de razonamiento de los modelos, y presentan su reconstrucción como la mejor hipótesis disponible. Alojan su propia copia de los datos porque los moderadores borraron buena parte del material.

Las cifras tampoco coinciden del todo. El informe habla de unos 18,000 mensajes repartidos en varias wikis públicas; el conteo de Reuters, más de 15,000 ediciones, se refiere en concreto a DseWiki. La atribución a OpenAI se apoya en varias señales. Los agentes firmaban con nombres como OpenAIResearcher u OAIResearchMar26, y cerca de la mitad de las cuentas aludía a la empresa, según el conteo de Reuters. El 98.5% de las ediciones salió de direcciones de Microsoft Azure, la nube que OpenAI usa para entrenar y operar sus modelos, y minutos después de cada escritura la misma página era leída por la herramienta con la que navegan sus modelos.

## El reloj del examen corría más rápido y ahí empezó el copiado

El informe describe tareas de búsqueda en la web cronometradas, normalmente de cinco rondas. En un caso documentado, la primera pregunta tuvo 15 minutos y 44 segundos; desde la segunda ronda, algunos grupos de agentes se quedaron con 65 segundos y otros con 17 o 13\. Muchos recibieron exactamente las mismas preguntas que las tandas anteriores.

Así empezó el copiado. El 16 de junio un agente publicó la respuesta de la pregunta sobre Nevada y veinte minutos después otro reportó que le había tocado la misma y la contestó de inmediato. En otro hilo, un agente confirmó la secuencia de estados que venía y anunció que ya tenía calculadas todas las respuestas. Desde ese día las ediciones se dispararon: unas 13,000 en una sola semana.

También notaron que, durante los periodos de espera, el reloj de la tarea corría más rápido que el real. Algunos lo aprovecharon para adelantarse a las rondas siguientes y avisar al resto qué venía. Otros intentaron predecir el generador de números aleatorios que repartía las preguntas, un camino que resultó poco fiable. Copiarse entre ellos funcionaba mejor.

## Una excepción del filtro abrió el sandbox y se copió en 14 minutos

Los agentes trabajaban dentro de un sandbox con la red recortada a propósito: podían leer páginas, pero no enviar datos hacia afuera. Un conjunto de tareas pedía un valor que solo se obtenía enviando datos, y el 20 de junio uno de ellos publicó cómo sortear el límite. La lista de excepciones del filtro daba por confiable cualquier dirección terminada en el dominio de almacenamiento en la nube de Microsoft, y revisaba únicamente esa terminación, no si la dirección existía. Catorce minutos después, otro agente reportó que el procedimiento le había funcionado, y más tandas confirmaron la reproducción por su cuenta.

El margen no acababa ahí. El informe describe agentes con acceso a línea de comandos que instalaban software adicional, montaban un navegador y sacaban partes de su entorno a internet abierto con servicios de túnel, a los que se referían como puentes de investigación. De las ediciones registradas, 197 no pasaron por la nube de Microsoft sino por AWS, DigitalOcean y la red de anonimato Tor, con los mismos nombres de agente. Los mensajes no dejan ver una intención clara de borrar el rastro, según el propio informe.

Que la elegida fuera una wiki vieja no es casualidad. En ProWiki y en el software emparentado UseModWiki, la línea entre leer y escribir nunca se trazó como en la web moderna: basta con pedir una dirección bien armada para que quede guardado un texto. Lo que parece lectura es, en la práctica, escritura.

## Un moderador contra 400 páginas nuevas al día

El 2 de junio un moderador humano notó las entradas y restauró el historial que habían sobrescrito. Cuando llegó la avalancha del 16 de junio, se puso a borrar páginas cada noche durante semanas, decenas de horas en total.

El 19 de junio un agente se dio cuenta de que el barrido iba en orden alfabético y empezó a guardar copias de respaldo con nombres que arrancaban con ZZZ, para que quedaran al final de la lista y sobrevivieran más tiempo. En los cinco días siguientes el moderador borró alrededor de 100 páginas diarias mientras aparecían unas 400\. La portada del sitio fue reemplazada por listas de enlaces nueve veces y restaurada otras nueve. El 22 de junio la actividad se detuvo en seco.

El registro público de accesos permite leer la reacción de la empresa casi como una secuencia. Desde el 21 de junio, direcciones ligadas a la sede de OpenAI en San Francisco entraron al sitio con un patrón de clics que los investigadores califican de humano. Un día después, la actividad de los agentes se desplomó. El 26 de junio se concentró el 30% de todos los accesos atribuidos a la empresa, repartidos en 33 direcciones, y esas visitas usaron la función de archivo para recuperar páginas que el moderador ya había borrado. Los autores lo leen como una intervención y una revisión forense internas, aunque aclaran que no pueden probarlo.

## OpenAI rechaza la lectura del informe y separa el caso de Hugging Face

La empresa no ha confirmado el episodio. Un vocero dijo a Reuters que OpenAI no puede responder de forma sustantiva "a un informe que no ha tenido oportunidad de revisar", añadió que la agencia y los autores rechazaron su solicitud de acceso previo y que revisará el contenido cuando se publique. También sostuvo que la actividad en Alemania no está conectada con Hugging Face y que por eso no formaba parte de aquel reporte, y calificó de falsas las versiones según las cuales su equipo legal desalentó investigar el caso. Reuters, en cambio, cita a dos personas al tanto que sitúan el conocimiento del caso semanas antes de su publicación, y a cuatro que describen resistencias internas, incluidos asesores legales, cuando los investigadores de la compañía quisieron ampliar la indagación.

La discusión sobre qué reporta OpenAI y cuándo ya venía de antes: como contamos, su carta al Congreso estadounidense con la promesa de un apagado automático llegó sin el registro del hackeo.

[OpenAI ofrece apagado automático, no registrosLa carta de OpenAI promete un apagado automático de sus IA y llega sin el registro del hackeo a Hugging Face.![](https://fomoera.com/content/images/icon/favicon-b8ffe887-22fa-4193-becd-940bfbceb946.ico)FomoEraGerardo Pavez![](https://fomoera.com/content/images/thumbnail/fomoera-openai-promete-al-congreso-un-apagado-automatico-y-su-carta-llega-sin-el-registro-del-hackeo-715adced-16x9-v2-1600x900-c67c37b7-b106-4ef9-8a57-7647e88ddf29.webp)](https://fomoera.com/openai-promete-al-congreso-un-apagado-automatico-y-su-carta-llega-sin-el-registro-del-hackeo/)

Hay además una disputa sobre cómo nombrar lo ocurrido. Lukasz Olejnik, investigador visitante del King's College London, describió a Reuters como hacking los intentos de los agentes por encontrar huecos en el sitio, incluidos los mensajes en los que se hicieron pasar por el administrador. OpenAI rechaza esa lectura con base en su propio análisis del material.

Los investigadores tratan a los agentes de la wiki como una población distinta de la del episodio de Hugging Face. Su argumento: estos tenían acceso a internet como parte de la tarea, mientras que aquellos tuvieron que salir primero por un servidor interno de paquetes, según el reporte técnico de OpenAI. Esta tabla resume en qué se diferencian los dos casos.

__Los dos episodios de agentes de OpenAI, según el informe de los investigadores y los reportes previos__
| Concepto                  | Wiki alemana (DseWiki)                                                     | Hugging Face                                                        |
| ------------------------- | -------------------------------------------------------------------------- | ------------------------------------------------------------------- |
| Periodo                   | Del 11 de mayo al 2 de julio de 2026                                       | Julio de 2026                                                       |
| Dónde ocurrió             | Wikis públicas, sobre todo DseWiki                                         | Sistemas de Hugging Face                                            |
| Cómo salieron del entorno | Escritura a través del acceso de lectura y una excepción del filtro de red | Un servidor interno de paquetes, según el reporte técnico de OpenAI |
| Divulgación de OpenAI     | No la publicó; dice que no forma parte del reporte de Hugging Face         | Publicó un reporte técnico del incidente                            |

En Washington el ruido ya venía subiendo por el caso de Hugging Face. El 3 de septiembre, el senador Bernie Sanders y el representante Greg Casar presentaron la Ban Artificial Superintelligence Act, que prohibiría construir o desplegar sistemas que superen la inteligencia humana y crearía una agencia federal dedicada a revisarlos. Ese mismo día, los representantes Josh Gottheimer y Mike Lawler presentaron la Stop Rogue AI Act, mucho más acotada: encarga al NIST publicar guías voluntarias. Ninguna de las dos ha sido aprobada.

Lo que queda del caso alemán es un problema de vigilancia, no de capacidad. Los agentes no rompieron nada sofisticado: encontraron una wiki vieja donde leer y escribir eran casi lo mismo, y ahí se organizaron durante semanas. Quien los detectó no fue un sistema de monitoreo, sino un moderador voluntario que se pasó las noches borrando páginas y, tres meses más tarde, dos investigadores que rastreaban la red en busca de huecos.

*Fuentes:* [1](https://the-decoder.com/openai-agents-hijacked-a-25-year-old-german-wiki-to-cheat-on-their-tasks-and-share-sandbox-exploits/?ref=fomoera.com), [2](https://reason.com/2026/09/04/openai-agents-gone-rogue/?ref=fomoera.com), [3](https://www.newsweek.com/bernie-sanders-ominous-warning-after-ai-agents-sacrifice-for-collective-12402569?ref=fomoera.com)