Anthropic presenta Claude Opus 5.5, su modelo más seguro y hasta un 40% más barato

Anthropic ha presentado Claude Opus 5.5, su modelo de IA más potente hasta la fecha, con un enfoque en seguridad y eficiencia. La compañía asegura que este lanzamiento reduce el coste para los usuarios hasta un 40% en comparación con su predecesor, y llega en un momento de atención creciente sobre los riesgos de los agentes autónomos.
Seguridad reforzada en un entorno de desconfianza
El lanzamiento de Claude Opus 5.5 llega después de que Anthropic se sumara al llamamiento de una pausa en el desarrollo de la IA, una posición compartida por otros laboratorios como OpenAI y Microsoft. La compañía afirma que este es el primer modelo evaluado bajo el nuevo estándar de cautela que la industria está impulsando.
Según la información publicada por Hipertextual, Opus 5.5 obtuvo las mejores puntuaciones en las pruebas de alineamiento de Anthropic, que miden la capacidad del modelo para actuar dentro de los límites establecidos. La empresa destaca que el modelo tiene una menor tendencia a tomar acciones difíciles de revertir y resiste mejor los intentos de prompt injection, una técnica con la que los atacantes intentan manipular el comportamiento de la IA mediante instrucciones maliciosas.
Antes de su lanzamiento, el modelo fue sometido a evaluaciones externas por parte de Frontier Design y METR. En la prueba de alineamiento más exhaustiva que aplica la empresa, Opus 5.5 es el modelo con mejor desempeño. Además, la compañía ha añadido capas de protección adicionales a los agentes: un clasificador que revisa cada acción antes de ejecutarla, un entorno aislado que puede ser auditado por un equipo de seguridad y una revisión automática que detecta vulnerabilidades. Esto responde directamente a la oleada de temores y críticas desatada tras el hackeo de Hugging Face por parte de agentes autónomos de OpenAI, un incidente que ha puesto el foco en los sistemas de seguridad de estos modelos.
Mayor rendimiento con un coste menor
Claude Opus 5.5 se presenta como un modelo más rápido y eficiente que su antecesor. En las pruebas internas de Anthropic, el modelo completó tareas de desarrollo de software complejas, como la auditoría y corrección de una base de código de 200.000 líneas, en menos de tres horas. Claude Opus 5, por el contrario, necesitó más de 20 horas y un 2,5 veces más de poder de procesamiento para lograr un resultado similar.
En otra prueba, la compañía le pidió completar un proyecto de migración con 680.000 líneas de código en menos de un día, una tarea que a un equipo de ingenieros le habría tomado semanas. También probó la capacidad del modelo para traducir la herramienta HAProxy del lenguaje C a Rust, una tarea que completó en 9,5 horas y con un 51% menos de recursos que Fable 5.1.
En el ámbito del análisis y redacción de informes, el modelo superó el estándar de calidad exigido en 16 de 18 intentos, verificando cada dato y cita contra las fuentes originales. Sus predecesores, Opus 5 y Fable 5.1, no alcanzaron la marca requerida en ningún intento. En un test interno en el que se le pidió reducir los tiempos de carga en todas las páginas de una aplicación web, Opus 5.5 tuvo éxito en 39 de los 40 intentos sin alterar el comportamiento de la aplicación.
Disponibilidad y ahorro para las empresas
El ahorro económico es uno de los puntos centrales del anuncio. Opus 5.5 requiere menos cálculos que el modelo anterior, lo que se traduce en un ahorro de hasta el 40% en cargas de trabajo típicas. Este dato es relevante para las empresas que buscan reducir costes operativos sin renunciar a la capacidad de la IA generativa.
El modelo ya está disponible en la web, en la aplicación móvil y a través de los principales proveedores de nube, como Amazon Web Services, Google Cloud y Microsoft Azure. Además, el modo rápido para Opus 5.5 está disponible en Claude Code y a través de la API, con un coste de 0,2 dólares por millón de tokens en lecturas de caché.
Con esta versión, Anthropic busca posicionarse en un mercado donde la seguridad y el coste son factores diferenciales. La compañía asegura que el modelo es menos propenso a salirse de control, algo que resulta crítico en un contexto donde los agentes autónomos y el hackeo de sistemas como Hugging Face han generado preocupación en la industria. En teoría, las empresas que dejan a estos agentes operar de forma autónoma durante largos períodos ya no tendrán que preocuparse de su seguridad.



