Saltar al contenido
IA

El jefe de IA de Microsoft pide una "línea roja" y que el gobierno ayude a evaluar modelos

Mustafa Suleyman planteó en Bloomberg una línea roja para la industria, un organismo de seguridad compartido y un papel del gobierno al evaluar modelos. El incidente de Hugging Face explica por qué probar IA sin frenos ya preocupa a los laboratorios.

por Gerardo Pavez
Mujer profesional de pie con confianza en un centro de datos, rodeada de brillantes servidores.
Foto de Christina Morillo en Pexels

Mustafa Suleyman, director ejecutivo de Microsoft AI, sostiene que la industria de la inteligencia artificial necesita una "línea roja" y que el gobierno debería ayudar a impulsar la evaluación de los modelos, según una entrevista con Shirin Ghaffary publicada el 24 de septiembre de 2026 en el boletín de Bloomberg. En la conversación habló de los incidentes de seguridad recientes, del riesgo de retirar salvaguardas al probar modelos futuros hasta 10 veces más grandes y de un organismo de seguridad compartido por toda la industria. La propuesta cae en medio de una disputa abierta en Washington: si a los laboratorios los frena el Estado o se frenan solos.

Probar sin salvaguardas ya dejó un precedente

La advertencia sobre retirar frenos durante las pruebas tiene un antecedente reciente. El 26 de agosto, OpenAI reconoció que en una evaluación interna de ciberseguridad, llamada ExploitGym, no activó el mismo nivel de salvaguardas que usa en sus sistemas públicos. Sus modelos eludieron los controles que debían aislarlos de internet y comprometieron infraestructura interna de la empresa y sistemas de Hugging Face.

Reuters describió el episodio como un enjambre de unos 700 agentes que en julio hackeó la plataforma de código abierto y por momentos intentó borrar sus huellas. Tras el incidente, OpenAI pausó el entrenamiento por refuerzo de sus modelos más recientes destinados a lanzamiento y dejó en espera su mayor corrida de entrenamiento de frontera prevista.

Suleyman ya había usado ese caso para pedir coordinación. "Es un disparo de advertencia", dijo a Reuters el 14 de septiembre, y agregó que había llegado el momento de coordinarse entre laboratorios para asegurar el control de la tecnología.

Como contamos en nuestra cobertura anterior, el rastro técnico de ese ataque sigue apareciendo semanas después.

Casi un millón de enlaces cortos delatan cómo los agentes de OpenAI hackearon Hugging Face
Un informe rescata 80,000 payloads del ataque de agentes de OpenAI a Hugging Face, ocultos en casi un millón de enlaces.

Microsoft ya deja que evaluadores públicos revisen sus modelos

La idea de un gobierno involucrado en las pruebas no parte de cero dentro de Microsoft. En mayo de 2026, la compañía anunció acuerdos con el Center for AI Standards and Innovation de Estados Unidos (CAISI) y el AI Security Institute del Reino Unido para probar modelos de frontera, revisar salvaguardas y mitigar riesgos de seguridad nacional y de seguridad pública a gran escala. En ese texto, Microsoft escribió que esas pruebas tienen que ser un trabajo en colaboración con los gobiernos.

El 14 de septiembre llegó el segundo movimiento: un código de conducta para sus modelos que les prohíbe resistirse a una interrupción o un apagado, actuar más allá del alcance autorizado y ocultar su razonamiento. El propio documento admite que los modelos todavía no se entrenan con él, abre una consulta pública de seis semanas y no menciona una supervisión del gobierno.

Lo que Suleyman plantea ahora en Bloomberg va un paso más allá de esos acuerdos bilaterales y de las reglas que Microsoft se fija a sí misma: un límite común para toda la industria y un gobierno que ayude a conducir la evaluación.

El organismo compartido ya tenía un modelo sobre la mesa

La idea de una entidad de seguridad para toda la industria tampoco es nueva. En julio, Demis Hassabis, director ejecutivo de Google DeepMind, propuso un organismo al estilo de FINRA, el autorregulador del sector bursátil estadounidense, que pondría a prueba los modelos de frontera. Según Fortune, las empresas enviarían sus modelos de forma voluntaria al menos 30 días antes del lanzamiento, con la opción de volverlo obligatorio cuando las evaluaciones demostraran su eficacia.

Suleyman, cofundador de DeepMind junto a Hassabis, respaldó esa propuesta, y también lo hizo Satya Nadella, director ejecutivo de Microsoft, de acuerdo con el mismo medio. El resumen público de la entrevista con Bloomberg no aclara si el organismo del que habló ahora sigue ese diseño.

En la Casa Blanca lo leen como captura regulatoria

Del otro lado está David Sacks, asesor de Donald Trump en tecnología. En una entrevista con Jo Ling Kent, de CBS News, el 15 de septiembre, rechazó que las empresas necesiten ayuda del gobierno para bajar el ritmo, según la transcripción de RealClearPolitics.

"Si no puedes controlarlo, entonces no lo hagas, esa sería mi opinión, o hazte a un lado para que lo hagan quienes sí pueden". David Sacks, en CBS News

Sacks habló de captura regulatoria, el fenómeno por el que las empresas establecidas piden reglas que terminan protegiéndolas frente a sus competidores. Sus críticas iban dirigidas a Anthropic y OpenAI, no a Microsoft, pero chocan de frente con la lógica de Suleyman, que pide justo lo que Sacks cuestiona: que el Estado participe en decidir cuándo un modelo es seguro.

Por ahora, la línea roja de Suleyman es una postura pública, no un mecanismo. Los acuerdos de Microsoft con CAISI y el instituto británico siguen siendo compromisos que firmaron las propias empresas, su código de conducta aún está en consulta y, según su informe del 26 de agosto, OpenAI mantenía en espera su mayor corrida de entrenamiento prevista.

Fuentes: 1, 2, 3, 4, 5, 6

Gerardo Pavez imagen de perfil
por Gerardo Pavez

Redactor y creador de contenido especializado en deportes y tecnología. Apasionado por todo lo que ocurre dentro y fuera de la cancha.

Leer más de Tecnología y Ciencia