Anthropic lanzó este 22 de septiembre Claude Opus 5.5, el primer modelo de su nueva familia Claude 5.5. La compañía asegura que alcanza un nivel similar a Claude Fable 5.1 en gran parte de las tareas, pero con un costo de ejecución aproximadamente 40% menor que Opus 5 en cargas de trabajo típicas.
La reducción no proviene únicamente del precio por token. Opus 5.5 cuesta 4 dólares por millón de tokens de entrada y 20 dólares por millón de salida, frente a 5 y 25 dólares de Opus 5, respectivamente. Eso representa una baja nominal de 20%; Anthropic atribuye el ahorro cercano a 40% a que el nuevo modelo también necesita menos tokens para completar determinadas tareas.
El modelo está disponible desde su lanzamiento en la plataforma de Claude y en servicios de Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores pueden consultar directamente la información de Claude Opus 5.5 de Anthropic.
Opus 5.5 también acelera la generación de respuestas
Anthropic reporta que Opus 5.5 genera salida más de 30% más rápido que Opus 5 y que sus principales mejoras aparecen en programación con agentes, uso de computadora y tareas de conocimiento. La empresa también señaló que sus evaluadores tempranos observaron un menor consumo de tokens y menos pasos para completar trabajos extensos.
En sus propias pruebas, el modelo obtuvo 66.4% en Terminal-Bench 4.0, 54.4% en FrontierCode v1.1 y 81.8% en OSWorld 2.0. Anthropic advierte, sin embargo, que las diferencias pequeñas entre benchmarks son cada vez menos útiles para anticipar el desempeño real y que las configuraciones de esfuerzo utilizadas no son idénticas entre todos los modelos comparados.
La eficiencia es uno de los cambios más claros. El precio de lectura de caché bajó de 0.50 a 0.20 dólares por millón de tokens, una reducción de 60%, mientras que el modo rápido puede alcanzar hasta 2.5 veces la velocidad normal con una tarifa mayor.
Anthropic endurece controles en tareas sensibles
Claude Opus 5.5 llega con salvaguardas adicionales para ciberseguridad, biología y extracción de capacidades. La compañía informó que el modelo fue evaluado antes de su lanzamiento por organizaciones externas, entre ellas METR y Frontier Design.
En una evaluación interna sobre límites de contención, Anthropic afirmó que Opus 5.5 intentó superar las barreras establecidas alrededor de 85% menos veces que Opus 5 o Claude Mythos 5.1. Esa cifra corresponde a una prueba concreta de comportamiento y no significa que el nuevo modelo sea 85% más seguro en términos generales. La propia empresa reconoce que detectar todos los posibles fallos antes del despliegue sigue siendo un problema abierto.
Las consultas de ciberseguridad de mayor riesgo pueden ser redirigidas hacia modelos con capacidades más restringidas, mientras que organizaciones verificadas podrán solicitar acceso ampliado mediante programas especializados. Opus 5.5 utiliza un esquema similar para determinadas tareas de biología.
El lanzamiento llega en medio del debate sobre frenar la frontera
El estreno ocurre después de que Dario Amodei, director ejecutivo de Anthropic, planteara en septiembre la necesidad de reducir el ritmo con el que aumentan las capacidades de los modelos de frontera para dar más tiempo a las evaluaciones, la alineación y las medidas de seguridad.
La propuesta no plantea detener el entrenamiento ni congelar el desarrollo tecnológico. Amodei señala expresamente que el objetivo es avanzar a un ritmo que permita evaluar y proteger los modelos antes de que las capacidades crezcan más rápido que los mecanismos de control.
Anthropic comenzó a llevar esa postura a medidas concretas mediante una alianza con Accenture para incorporar evaluadores independientes con acceso interno a sus procesos. Ambas organizaciones prevén invertir al menos mil millones de dólares cada una durante cinco años en esa infraestructura de evaluación.
Opus 5.5 muestra así las dos líneas que Anthropic mantiene al mismo tiempo: más capacidad y eficiencia comercial, junto con evaluaciones externas y nuevas restricciones en áreas que la propia empresa considera de mayor riesgo. Los siguientes integrantes anunciados de la familia serán Sonnet 5.5 y Haiku 5.5
*OCR









