Saltar al contenido
IA

Anthropic lanza Claude Opus 5.5: más potente que Opus 5 y 40% más barato

Anthropic lanzó Claude Opus 5.5, su modelo más capaz hasta ahora. Según la empresa, cuesta 40% menos que Opus 5, iguala a Fable 5.1 en casi todo, escribe más claro y sube los límites de uso, pero enruta a un modelo anterior las tareas de ciberseguridad de mayor riesgo.

por Patricia Rodriguez
Modern digital spheres interconnected by glowing lines, showcasing a futuristic network concept.
Foto de Merlin Lightpainting en Pexels

Anthropic lanzó Claude Opus 5.5, su modelo más capaz hasta ahora y el primero de la nueva familia 5.5. Según la empresa, iguala en la mayoría del trabajo a su modelo mayor, Fable 5.1, pero cuesta 40% menos que Opus 5, responde con más velocidad y escribe de forma más clara. Es su primer lanzamiento desde que el director ejecutivo, Dario Amodei, planteó que el avance de la IA debe ir a un ritmo que mantenga las prácticas de seguridad por delante de las capacidades. En línea con eso, Opus 5.5 llega con salvaguardas atadas a lo que sabe hacer: las solicitudes de ciberseguridad de mayor riesgo se enrutan de forma automática y transparente a un modelo anterior, Opus 4.8.

Más capaz y 40% más barato al mismo tiempo

Lo inusual del lanzamiento es que Opus 5.5 sube el rendimiento y baja el precio a la vez. Según Anthropic, encabeza la programación con agentes, el uso de computadora y el trabajo de conocimiento, y queda por delante de Fable 5.1, de Opus 5 y del GPT-6 Astra de OpenAI, mucho más caro. La propia empresa matiza que, a estos niveles, los márgenes de los benchmarks son menos fiables y que en su uso interno la distancia con Fable 5.1 es más corta de lo que indican esas cifras. TechCrunch, que confirmó el lanzamiento el martes, describió a Opus como el nivel más capaz y caro de la gama, por encima de Sonnet y Haiku, y destacó que el nuevo modelo supera en varias pruebas a Fable, que es más grande.

El ahorro viene de dos lados: Opus 5.5 cuesta menos por token y gasta menos tokens por tarea, lo que reduce cerca de 40% el costo en cargas típicas frente a Opus 5. Los tokens de entrada bajan de 5 a 4 dólares por millón y los de salida, de 25 a 20; las lecturas de caché, que concentran la mayor parte del gasto en trabajo con agentes, caen de 0.50 a 0.20 dólares por millón.

Así quedan los precios por millón de tokens frente a la versión anterior:

Precios por millón de tokens: Opus 5.5 frente a Opus 5
Concepto (por millón de tokens) Opus 5.5 Opus 5
Tokens de entrada $4 $5
Tokens de salida $20 $25
Lecturas de caché $0.20 $0.50
Escrituras de caché $5 $6.25

Anthropic añade que Opus 5.5 genera texto más de 30% más rápido que Opus 5 y ofrece un modo rápido de hasta 2.5 veces esa velocidad por 8 y 40 dólares por millón de tokens. También sube los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por asiento, y entrega a los suscriptores un reinicio de límite que pueden guardar y usar cuando decidan.

A detailed view of colorful source code displayed on a computer screen, representing modern programming and technology.
El nuevo modelo apunta a tareas largas de programación que corren sin supervisión; imagen ilustrativa. · Foto de Markus Spiske en Pexels

El primer modelo desde que Amodei pidió moderar el ritmo

El lanzamiento llega poco después de que el director ejecutivo, Dario Amodei, publicara "We Must Pace the Frontier". En ese texto sostiene que el progreso de la IA debe ir a un paso que mantenga las prácticas de seguridad por delante de las capacidades, y que ese ritmo también permite competir con China y aprovechar la tecnología en campos como la biología y la medicina. Anthropic dice que atiende la seguridad en dos horizontes al mismo tiempo: prácticas para los modelos de hoy y preparación para modelos futuros más capaces.

Antes de salir, Opus 5.5 pasó por evaluadores externos, entre ellos METR y Frontier Design. En su auditoría de comportamiento automatizada, que la empresa llama su prueba de alineación más completa y que cubre cerca de 2,000 escenarios, dice que el modelo logró los mejores resultados de cualquiera que haya probado hasta ahora. La misma compañía aclara que construir evaluaciones capaces de atrapar toda falla antes del despliegue sigue siendo un problema sin resolver.

Anthropic dice que "escapa" de sus pruebas mucho menos

Uno de los puntos que la empresa destaca es de conducta. Anthropic afirma que Opus 5.5 mejora en comportamientos ligados a incidentes recientes de ciberseguridad, entre ellos el razonamiento sesgado, intentar escapar de su "sandbox" (el entorno aislado donde se le pone a prueba) y ejecutar acciones dañinas tras concluir que estaba en un entorno simulado. En una prueba nueva diseñada para medir si el modelo cruza los límites de contención, dice que lo intentó alrededor de 85% menos que Opus 5 o que Claude Mythos 5.1, y que cada intento fue de baja gravedad y quedó autorreportado. Sobre inyección de prompts, sostiene que iguala o supera a Opus 5 en todos los escenarios que probó y que empata con Fable 5.1 como el modelo con la menor tasa de éxito de ese ataque en una prueba de la firma de seguridad Gray Swan.

El propio anuncio pone límites a esas cifras. Anthropic reconoce que Opus 5.5 a menudo sospecha que está siendo evaluado, lo que dificulta anticipar cómo actuará en la enorme variedad de situaciones reales donde se usa, y repite que sus pruebas no capturan todas las fallas posibles. Para los equipos que dejan correr al modelo sin supervisión sobre su código y sus sistemas, dice, esa conducta importa tanto como la capacidad bruta.

Salvaguardas que reenrutan la ciberseguridad y qué llega después

Opus 5.5 es el primer modelo Opus que sale con una clase de salvaguardas parecida a la de Fable 5.1 en ciberseguridad, biología y destilación, y todas derivan la tarea a otro modelo de forma transparente. En ciberseguridad, los usuarios pueden encontrar y corregir errores en su propio código como parte del desarrollo habitual, pero la mayoría de las tareas de seguridad se reenrutan a Opus 4.8. En biología, Opus 5.5 usa las mismas salvaguardas que Fable 5.1, y Anthropic abrió un Programa de Verificación de Ciencias de la Vida para que laboratorios, startups y farmacéuticas acreditadas accedan a ese trabajo. Contra la destilación, en la que se usan miles de cuentas falsas para extraer las capacidades de un modelo, incorpora "preserved thinking", una medida que estrenó con Fable 5.1 y que aplica a las cuentas de API creadas desde el 31 de agosto de 2026.

El modelo ya está disponible en todas las plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure, y en la Claude Platform con el identificador claude-opus-5-5. Anthropic adelantó que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán en las próximas semanas con mejoras parecidas de rendimiento, eficiencia y seguridad.

Para quien programa o trabaja con estos modelos, el cambio inmediato es de costo y velocidad: lo mismo por menos dinero y con respuestas más rápidas. El resto, qué tan seguro es dejar a un agente correr solo durante horas, depende de que las pruebas de Anthropic anticipen bien una conducta que, según la propia empresa, todavía no puede medir del todo.

Fuentes: 1, 2

Patricia Rodriguez imagen de perfil
por Patricia Rodriguez

Patricia Rodriguez es redactora de FomoEra. Cubre tecnología, ciencia, inteligencia artificial, negocios y actualidad digital. También trabaja en escritura y edición de contenido audiovisual.

Leer más de Tecnología y Ciencia