Anthropic lanza Claude Opus 5.5: su IA más segura y barata hasta ahora

Wait 5 sec.

A unos días de pedir una pausa en el desarrollo de la IA, Anthropic anunció Claude Opus 5.5, uno de sus modelos más poderosos. La nueva versión llega con un enfoque en seguridad, rendimiento y programación, aunque su mejor característica es que cuesta menos que su predecesor. De acuerdo con Anthropic, este es el primer modelo evaluado bajo el nuevo estándar de cautela que pide la industria.En términos prácticos, Claude Opus 5.5 es un modelo más rápido, barato y seguro cuando se compara con Opus 5. Anthropic afirma que su nueva IA consiguió completar un proyecto de migración con 680.000 líneas de código en menos de un día, algo que a un equipo de ingenieros le habría tomado semanas. Opus 5.5 requiere menos cálculos que el modelo anterior, por lo que los usuarios se ahorrarían hasta un 40% en cargas de trabajo típicas.La parte más importante del anuncio tiene que ver con la seguridad. Anthropic, al igual que OpenAI, Microsoft y otros laboratorios de IA, han empujado el discurso apocalíptico durante las últimas semanas. El hackeo de Hugging Face por parte de agentes autónomos de OpenAI desató una oleada de temores y críticas hacia los sistemas de seguridad que tienen estos modelos. Sobre esta línea, Anthropic dice que Claude Opus 5.5 consigue las mejores puntuaciones de seguridad y es menos probable que se salga de control.Antes de su lanzamiento, la compañía sometió el modelo a evaluadores externos como Frontier Design y METR. En la prueba de alineamiento más exhaustiva que aplica la empresa, Opus 5.5 es el modelo con mejor desempeño. Anthropic dice que tiene mucha menor tendencia a tomar acciones difíciles de revertir o a actuar fuera de los límites que se le establecen. Esta versión resiste mejor los intentos de prompt injection, en donde los hackers escriben instrucciones maliciosas para manipular el comportamiento de la IA.Claude Opus 5.5 da un salto notable en rendimiento y desarrollo de softwareMás allá de la seguridad, Claude Opus 5.5 es una bala en cuanto a rendimiento. Según las primeras pruebas, el modelo puede completar trabajos complejos en menor tiempo y detectar ineficiencias. En un test interno en donde se le pidió reducir los tiempos de carga en todas las páginas de una aplicación web, Opus 5.5 tuvo éxito en 39 de los 40 intentos sin alterar el comportamiento de la aplicación.En el caso de trabajos de análisis y redacción de informes, Claude pudo elaborar un reporte sobre los resultados trimestrales de una empresa usando fuentes difíciles de localizar. Un evaluador verificó cada dato y cita contra las fuentes originales y encontró que Opus 5.5 superó el estándar de calidad exigido en 16 de 18 intentos. Esta versión superó a Opus 5 y Fable 5.1, quienes no consiguieron alcanzar la marca requerida en ningún intento.Pasando al desarrollo de software, Claude Opus 5.5 demostró su utilidad en tareas como auditorías y migraciones de bases de código completas. Un usuario auditó y corrigió una base de 200.000 líneas en menos de tres horas, frente a las más de 20 horas que le tomó a Claude Opus 5, usando 2,5 veces más poder de procesamiento. En otra prueba, Anthropic le pidió traducir la herramienta HAProxy del lenguaje C a Rust, la cual completó en 9,5 horas y con un 51% menos de recursos que Fable 5.1.Siguiendo en este terreno, Anthropic añadió capas de protección adicionales a los agentes. Ahora contarán con un clasificador que revisa cada acción antes de ejecutarla, un entorno aislado que puede ser auditado por un equipo de seguridad, así como también una revisión automática que detecta vulnerabilidades. En teoría, las empresas que dejan a estos agentes operar de forma autónoma durante largos períodos ya no tendrán que preocuparse de su seguridad.Claude Opus 5.5 ya está disponible en la web, aplicación móvil y el resto de plataformas de desarrollo, entre las que se incluyen Amazon Web Services, Google Cloud y Microsoft Azure. El modo rápido para Opus 5.5 también está disponible en Claude Code y la API y tiene un coste de 0,2 dólares por millón de tokens en lecturas de caché.Seguir leyendo: Anthropic lanza Claude Opus 5.5: su IA más segura y barata hasta ahora