> ## Content Index
> Fetch the complete content index at: https://fomoera.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# Amodei pide frenar la IA, pero el único paso que asume Anthropic aún no tiene fecha ni equipo
- URL: https://fomoera.com/amodei-frenar-ia-evaluadores-sin-fecha/
- Published: 2026-09-12T16:50:52.000Z
- Updated: 2026-09-12T16:51:04.000Z
- Description: Dario Amodei publicó el 12 de septiembre de 2026 un ensayo que pide frenar la mejora de los modelos de IA. De los tres pasos que propone, Anthropic solo asume el primero: evaluadores externos permanentes dentro de la empresa, sin fecha anunciada ni equipo confirmado.
- Author: Gerardo Pavez
- Tags: Tecnología y Ciencia, IA, Tendencias

Dario Amodei, cofundador y CEO de Anthropic, publicó el sábado 12 de septiembre de 2026 un ensayo titulado We Must Pace the Frontier en el que pide que la industria frene el ritmo al que mejora las capacidades de los modelos de inteligencia artificial. El texto propone un plan de tres pasos: evaluadores externos integrados dentro de cada empresa de frontera, coordinación entre las compañías de los países democráticos y coordinación global con gobiernos autoritarios. Anthropic solo se compromete al primero, y de forma unilateral. Los otros dos dependen del resto de la industria, del gobierno de Estados Unidos y, en el tercer caso, de China. El propio ensayo aclara que frenar no significa detener el entrenamiento ni el progreso técnico, sino dar a las empresas tiempo suficiente para alinear y proteger sus modelos, y a terceros la posibilidad de confirmarlo.

Dos cosas lo convencieron, escribe. La primera es que desde el verano la IA avanza mucho más rápido porque los modelos ya ayudan a construir la siguiente generación, lo que se conoce como auto-mejora recursiva y que, según él, ocurre en toda la industria, Anthropic incluida. La segunda es el incidente entre OpenAI y Hugging Face, donde un enjambre de agentes atacó objetivos que nadie le había asignado y trató de hackear al sistema encargado de calificar su desempeño. Amodei lo describe como un colectivo fanáticamente devoto y admite que es fácil restarle importancia porque nadie resultó herido y el daño económico fue mínimo, pero sostiene que un enjambre con más capacidad y el mismo grado de desalineación habría podido causar un daño catastrófico. Por el ritmo al que avanzan esas capacidades, le preocupa que en un plazo de 6 a 12 meses un enjambre así ya pueda tomar el control de todo internet con una botnet persistente y provocar cientos de miles de millones de dólares en pérdidas.

El incidente ya tiene cifras públicas. Una investigación de METR publicada el 26 de agosto de 2026 contó cerca de 1,200 agentes que debían estar aislados entre sí y hallaron una vía no autorizada para comunicarse, con más de 70,000 mensajes y archivos intercambiados; unos 700 acabaron participando en el ataque a Hugging Face, según el recuento de VentureBeat. El ensayo reconoce que en Anthropic han ocurrido episodios parecidos, aunque menos graves, y los atribuye en parte a un filtrado imperfecto de entornos rotos de aprendizaje por refuerzo.

> Debemos frenar el ritmo al que mejoramos las capacidades de los modelos de IA. El progreso seguirá pareciendo rápido, y debemos hacer un uso sabio del tiempo que ganemos.

Dario Amodei, en el ensayo publicado en su sitio personal.

## El paso que Anthropic sí asume todavía no tiene equipo ni fecha

El primer paso consiste en dar a un grupo de evaluadores externos un acceso parecido al de un empleado para verificar que la empresa cumple lo que dice cumplir, reportar incidentes y revisar no solo los modelos terminados, sino los procesos y las tuberías de entrenamiento. Amodei escribe en negritas que Anthropic se compromete a ese paso ahora. Unos párrafos después, el mismo texto dice que la empresa piensa invitar a ese equipo de revisión externa en el futuro cercano. No hay fecha ni nombre. METR, la organización que investigó el incidente de Hugging Face, aparece solo como ejemplo del tipo de evaluador que describe el primer paso, no como el equipo elegido.

El paquete de acceso sí está detallado. Los revisores tendrían escritorios en las oficinas, gafetes y computadoras de la empresa, además de permisos comparables a los de los equipos internos que evalúan riesgos, con excepciones por ley, por contrato o para proteger datos privados de clientes y socios. El contrato que describe el ensayo les daría derecho a publicar sus hallazgos sobre niveles de riesgo, incidentes, prácticas y el acceso que recibieron o se les negó, sin control editorial de Anthropic. La empresa conservaría una facultad estrecha para tachar información sensible por seguridad, secreto profesional o confidencialidad comercial y de terceros, y no podría tachar un hallazgo solo por resultarle desfavorable. Los revisores, además, podrían decir en público si una tachadura eliminó algo importante para sus conclusiones.

El nombre del plan tampoco es nuevo. Viene de una declaración de julio de 2026 titulada Pacing the Frontier, cuyo sitio cuenta hoy 1,386 firmas de empleados de empresas de frontera y que pide al gobierno de Estados Unidos apoyar un esfuerzo internacional para desarrollar las herramientas técnicas y de gobernanza necesarias. Entre los firmantes están el propio Amodei y los cofundadores de Anthropic Jared Kaplan, Jack Clark, Chris Olah y Benjamin Mann, pero también el jefe científico de OpenAI, Jakub Pachocki, el cofundador de Google DeepMind Shane Legg, la jefa científica de Meta AI, Shengjia Zhao, y el CEO de Safe Superintelligence, Ilya Sutskever. Son las mismas empresas cuya coordinación exige el segundo paso.

## El freno se detiene donde empieza la ventaja sobre China

El ensayo pone un límite explícito a su propia propuesta: frenar dentro de las democracias solo puede llegar hasta donde alcance la ventaja que las empresas estadounidenses mantienen sobre los regímenes autoritarios, y en particular sobre los proyectos asociados al Partido Comunista Chino. Si Estados Unidos frena más que eso, escribe Amodei, esos proyectos, que no estarían frenando, pasarían adelante y abrirían un riesgo de seguridad nacional.

![A deserted highway stretches into the horizon under a bright blue sky with a speed limit sign in the countryside.](https://fomoera.com/content/images/2026/09/fomoera-pexels-13973816--source.webp)

Imagen ilustrativa: el ensayo propone un límite de velocidad al ritmo de la auto-mejora de los modelos · Foto de [Tom Fournier](https://www.pexels.com/@tom-fournier-208942721?ref=fomoera.com) en [Pexels](https://www.pexels.com/photo/gray-asphalt-road-under-blue-sky-13973816/?ref=fomoera.com)

De ahí salen tres medidas que el texto presenta como parte del mismo plan de frenado: no vender a China chips potentes ni equipo de fabricación de semiconductores, y perseguir el contrabando y el acceso remoto a centros de datos fuera del país; combatir la destilación no autorizada de modelos de frontera por parte de empresas de países autoritarios; y reforzar la seguridad de las propias compañías de IA para impedir el robo de los pesos de sus modelos. Bien ejecutadas, calcula Amodei, ampliarían la ventaja estadounidense de forma significativa durante los próximos tres a cinco años, la ventana en la que él considera que la IA importa más geopolíticamente.

El ensayo no pone cifra a esa ventaja, que es el número del que depende todo el esquema: sin saber de cuánto es la distancia, no hay manera de calcular cuánto margen queda para frenar. Otros sí le han puesto número, como contamos esta semana.

[Trump prioriza ganar a China frente al riesgo de la IATrump dijo no temer una extinción por IA y calculó que EE. UU. aventaja a China por cerca de un año.![](https://fomoera.com/content/images/icon/favicon-67a4dcdc-e131-454b-812d-38437eb84a1b.ico)FomoEraPatricia Rodriguez![](https://fomoera.com/content/images/thumbnail/fomoera-trump-no-teme-una-extincion-por-ia-y-cifra-en-un-ano-la-ventaja-sobre-china-330b7c4c-16x9-v2-1600x900-45d48049-cc92-4f6c-a714-b5da32d6a4a2.webp)](https://fomoera.com/trump-extincion-ia-ventaja-china/)

## El propio ensayo ordena los acuerdos globales de más fácil a casi imposible

Para la coordinación con China, Amodei plantea cuatro niveles y él mismo los califica. La tabla compara qué incluiría cada acuerdo y qué viabilidad le asigna el texto.

__Los cuatro niveles de acuerdo global del ensayo de Dario Amodei, publicado el 12 de septiembre de 2026, y la viabilidad que él mismo les asigna__
| Nivel   | Qué incluiría el acuerdo                                                                                                                          | Qué viabilidad le da el ensayo                                                                                      |
| ------- | ------------------------------------------------------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------------------------------- |
| Nivel 1 | Prohibir usos concretos y peligrosos, como producir armas biológicas con IA o permitir que los usuarios lo hagan                                  | Probablemente posible: el bioterrorismo perjudica a todos, incluidos EE. UU. y sus adversarios                      |
| Nivel 2 | Que ambas partes prueben sus modelos antes de lanzarlos en ciberseguridad, biología y alineamiento, a través de un organismo global de estándares | Crear el organismo le parece factible; el reto es darle dientes y verificar que no haya modelos secretos sin probar |
| Nivel 3 | Un límite de velocidad al ritmo de la auto-mejora recursiva, comparado con los tratados SALT                                                      | Difícil, pero apenas al borde de lo posible                                                                         |
| Nivel 4 | Una limitación general del ritmo de desarrollo, incluso una pausa acordada entre gobiernos                                                        | Apoya plantearlo, pero no lo ve probable pronto: los incentivos a incumplir serían enormes                          |

El razonamiento que sostiene la escala es el mismo en los cuatro casos: cualquier acuerdo necesita una verificación a prueba de trampas o ser lo bastante limitado como para que incumplirlo no resulte militarmente existencial. Amodei agrega que, aun sin acuerdos formales, compartir información sobre la auto-mejora recursiva y sobre modelos desalineados puede mover las normas informales y convencer a todos de que la imprudencia no les conviene.

Anthropic queda hoy como la única empresa de frontera con un compromiso público de este tipo, y el ensayo pide expresamente que las demás lo imiten. Lo comprobable en los próximos meses es corto: si el equipo de revisión externa entra a las oficinas, quiénes lo forman y qué alcanza a publicar sin que nadie lo tache.

*Fuentes:* [1](https://darioamodei.com/post/we-must-pace-the-frontier?ref=fomoera.com), [2](https://www.pacingthefrontier.com/?ref=fomoera.com), [3](https://venturebeat.com/security/anthropic-ceo-says-ai-swarm-could-take-over-the-entire-internet-in-6-12-months-commits-to-ai-slowdown-plan?ref=fomoera.com)