Saltar al contenido

Mythos 5, el modelo que Anthropic no lanzó al público, ya escanea código de empresas

Anthropic activó su modelo más capaz en ciberseguridad dentro de Claude Security para clientes Enterprise. El acceso llega empaquetado: el usuario recibe una lista de fallas con parche sugerido que un humano debe aprobar, sin caja de texto para conversar con el modelo.

por Dilis Salazar
Woman using multiple screens for cybersecurity tasks in a cozy home office
Foto de cottonbro studio en Pexels

TL;DR:

  • Anthropic activó Claude Mythos 5 dentro de Claude Security el 21 de agosto de 2026: los clientes de Claude Enterprise ya pueden escanear sus repositorios con el modelo que la empresa nunca abrió al público general.
  • Cada hallazgo regresa con categoría CWE, calificaciones de confianza y severidad, y un parche sugerido que un humano debe revisar y aprobar; los escaneos se cobran como consumo normal de tokens, sin cargo aparte.
  • El mismo anuncio suma un fondo de 35 millones de dólares en créditos para seguridad de código abierto y la ampliación del Cyber Verification Program hacia acceso de clase Mythos.

Anthropic empezó a correr Claude Mythos 5, su modelo más capaz en ciberseguridad y el que nunca abrió al público general, dentro de Claude Security, la herramienta que escanea bases de código en busca de vulnerabilidades. El cambio se anunció el 21 de agosto de 2026, aplica a los clientes de Claude Enterprise en beta pública y no exige contratar nada aparte: los escaneos se cobran como consumo normal de tokens del plan vigente. El argumento de la empresa no es que el modelo se haya vuelto menos peligroso, sino que cambió el envase. Quien usa Claude Security recibe una lista de hallazgos con su parche sugerido, sin caja de texto para conversar con el modelo. Junto al escáner, la compañía anunció 35 millones de dólares en créditos para asegurar software de código abierto y una ampliación de su programa de verificación para ciberdefensores.

En abril de 2026 Anthropic arrancó Project Glasswing y entregó Claude Mythos Preview, y después Mythos 5, a un grupo cerrado de organizaciones que protegen software crítico. En junio lanzó Claude Fable 5, el mismo modelo base pero con clasificadores que desvían las consultas de ciberseguridad y biología a un modelo menos capaz, y reservó Mythos 5 para los socios verificados. The New Stack calcula ese círculo en unos 150 participantes del programa. Es la misma familia de modelos que ya había mostrado hasta dónde llega: en julio, la propia empresa publicó dos resultados de criptoanálisis obtenidos con Mythos Preview.

Claude Mythos halló fallas en HAWK y AES
La IA de Anthropic mejoró ataques contra HAWK y una versión reducida de AES. Ningún sistema en uso cambia hoy.

Del repositorio de GitHub a una ficha por vulnerabilidad

El flujo es acotado a propósito. Un administrador habilita Claude Security desde la consola de administración, el usuario entra a claude.ai/security y conecta un repositorio de GitHub. Mythos 5 recorre el código siguiendo flujos de datos entre archivos y leyendo el historial de Git, en lugar de comparar contra un catálogo de reglas, según describe el detalle técnico que publicó MarkTechPost. Antes de mostrar un hallazgo, el modelo pasa por una verificación adversarial en la que intenta refutar su propio resultado, el mecanismo que Anthropic señala para bajar los falsos positivos.

Lo que llega al analista es una ficha por falla: categoría CWE, calificación de confianza, calificación de severidad y un parche propuesto. Aplicarlo es otro paso y ocurre en Claude Code en la web, donde corren los modelos que la organización ya tenía contratados. El escaneo con Mythos no extiende ese acceso a ninguna otra superficie, y ningún parche entra sin aprobación humana.

El corte comercial también es estricto: la función es exclusiva del plan Claude Enterprise. Los equipos en Pro, Max o Team quedan fuera del escaneo con Mythos, aunque el plugin de Claude Security para Claude Code siga en beta para todos, corriendo con los modelos de cada cuenta. El costo del modelo tampoco ayuda. The New Stack ubica a Mythos 5 en 10 dólares por millón de tokens de entrada y 50 por millón de salida.

A woman working late on a laptop with code displayed on the screen in a dark room.
El escaneo devuelve cada falla con su categoría CWE y un parche sugerido que un humano debe aprobar. Imagen ilustrativa. · Foto de cottonbro studio en Pexels

La frase "código que te pertenece" deja una pregunta abierta

Anthropic apoya el cambio en el diseño del producto. La empresa escribió en su anuncio que «el comportamiento más riesgoso ocurre cuando un usuario tiene acceso directo a un modelo», y sostiene que el riesgo baja mucho cuando la persona solo puede recibir salidas específicas, como un parche o una alerta. Bajo esa misma lógica están diseñadas las integraciones con proveedores de ciberseguridad: el usuario final nunca conversa con Mythos, sino que recibe el artefacto que el producto promete, y Anthropic dice que existen medidas antiabuso para mantener al modelo dentro de ese alcance.

El punto donde la frontera se afloja lo detectó Frederic Lardinois en The New Stack. Anthropic repite que Claude Security escanea el código que le pertenece al cliente, pero casi cualquier repositorio corporativo arrastra librerías de código abierto. Un desarrollador que clone una librería muy desplegada dentro de un repo de su empresa y apunte a Mythos 5 hacia ella recibiría los mismos hallazgos que buscaría un atacante, con la diferencia de que esa falla existe en todos los lugares donde esa librería se distribuye. El propio medio deja el asunto sin resolver, y Anthropic no ha detallado públicamente cómo trata ese escenario.

Los 35 millones del fondo son créditos de Claude

El Defender Advantage Fund (0xDAF) reparte 35 millones de dólares en créditos de Claude, no dinero en efectivo, entre organizaciones que ayuden a los mantenedores de proyectos abiertos. Anthropic fijó tres frentes: parchear vulnerabilidades vivas en proyectos de uso masivo, automatizar el escaneo y el parcheo de forma que otros proyectos puedan replicar, y empujar enfoques de seguridad que hagan a un proyecto resistente a clases enteras de ataque. Empezará con pocas becas grandes en modo piloto y publicará a los primeros beneficiarios en las próximas semanas.

El fondo continúa lo que Glasswing ya venía haciendo, incluidos 4 millones de dólares en donaciones directas a organizaciones de seguridad de código abierto y el apoyo a esfuerzos coordinados de corrección como Akrites y la iniciativa Gold Eagle de la Casa Blanca. La distinción importa para cualquier fundación que evalúe aplicar: un crédito de API cubre inferencia, no salarios ni infraestructura.

En paralelo, el Cyber Verification Program cambia de escalón. Hoy da salvaguardas reducidas a defensores verificados sobre modelos Opus y Sonnet; en las próximas semanas ampliará esas capacidades de doble uso y llevará tareas defensivas como el triaje y la validación de vulnerabilidades a modelos de clase Mythos. Las organizaciones ya aceptadas no tienen que hacer nada. Anthropic añadió que sigue abriendo acceso a Mythos por la vía de Glasswing junto con socios del gobierno de Estados Unidos, enfocado en operadores de infraestructura crítica que cumplan requisitos estrictos de control de seguridad.

Para un equipo de seguridad, la capacidad que hasta este anuncio vivía detrás de un programa por invitación ya se enciende desde una consola de administración, con la factura corriendo por el plan que ya se paga. Lo que no cambia es quién firma. Cada parche sigue necesitando que una persona lo revise y lo apruebe.

Fuentes: 1, 2, 3

Dilis Salazar imagen de perfil
por Dilis Salazar

Leer más de Tecnología y Ciencia