Anthropic lanzó este martes (22) el Claude Opus 5.5, un modelo que iguala el rendimiento de Fable 5.1 en la mayoría de las tareas y cuesta cerca de un 40% menos de ejecutar que su antecesor, Opus 5, según The Verge, SiliconANGLE, ZDNet y TechCrunch.
El precio por token bajó un 20%: la salida (output) pasó de 25 a 20 dólares por millón de tokens, según SiliconANGLE y TechCrunch. Como el modelo también necesita menos tokens para completar la misma tarea, el ahorro total llega al 40% que menciona la empresa en cargas de trabajo típicas, de acuerdo con ZDNet.
Opus es el nivel más caro y capaz de la familia Claude; Sonnet queda en el medio, y Haiku es el más rápido y barato, según TechCrunch. Anthropic afirma que Opus 5.5 genera respuestas más de un 30% más rápido que Opus 5, de acuerdo con SiliconANGLE y ZDNet, dos publicaciones especializadas en tecnología.
Menos intentos de sortear las pruebas de seguridad
La empresa dice que Opus 5.5 intentó sortear los límites de sus pruebas de seguridad un 85% menos que Opus 5, según The Verge y SiliconANGLE. Antes del lanzamiento, el modelo fue evaluado por dos socios externos, METR y Frontier Design, confirman las cuatro publicaciones.
Cuando esos mecanismos de seguridad se activan, las solicitudes relacionadas con ciberseguridad pasan a ser atendidas por el modelo más antiguo, Opus 4.8, en lugar de Opus 5.5 — la misma restricción que ya se aplica a Fable 5.1, de acuerdo con The Verge, SiliconANGLE y ZDNet. Para tareas de biología consideradas de alto riesgo, el acceso más amplio pasa por un programa de verificación con una vía específica para ciencias de la vida, según ZDNet y SiliconANGLE.
En cifras publicadas por Anthropic y citadas por SiliconANGLE, Opus 5.5 obtuvo 66,4% en Terminal-Bench 4.0, una prueba de programación por agentes, frente al 55,8% de Fable 5.1. En AutomationBench, una prueba de flujos de trabajo empresariales, el nuevo modelo completó el 40% de las tareas, frente al 26,9% de Opus 5, según la misma publicación. Estas cifras específicas provienen de una sola fuente consultada y no fueron confirmadas por otra.
SiliconANGLE también relata que, en una de las pruebas usadas por Anthropic, un evaluador completó una migración de código de 680.000 líneas en menos de un día — una tarea que, según la empresa, habría tomado semanas a un equipo de ingeniería completo. Este dato proviene de una sola fuente consultada y no fue confirmado por otra publicación.
En el mismo anuncio, Anthropic difundió testimonios de clientes: la ejecutiva Yashodha Bhavnani, de Box, y el director de producto de GitHub, Mario Rodriguez, afirman que el modelo ahora necesita menos pasos y menos tokens para completar tareas de código, según ZDNet y SiliconANGLE.
Primer modelo desde el plan de desacelerar
Opus 5.5 es el primer modelo que Anthropic lanza desde que su consejero delegado, Dario Amodei, anunció la intención de reducir el ritmo de los avances en capacidad de la IA para dar tiempo a los mecanismos de seguridad, según The Verge, TechCrunch y ZDNet.
El lanzamiento llega menos de dos meses después de Opus 5, que debutó en julio, de acuerdo con TechCrunch y ZDNet. Anthropic afirma que planea lanzar Claude Sonnet 5.5 y Claude Haiku 5.5 en las próximas semanas, según las cuatro publicaciones consultadas.
OpenAI lanzó dos modelos más baratos de su línea GPT-6, llamados Sol y Luna, el mismo día, según el propio anuncio de la empresa y otro de Amazon Web Services, el servicio de nube de Amazon.


