Anthropic hace hoy algo inusual: lanzar simultáneamente un modelo más capaz, más barato y más restringido en los usos de mayor riesgo. Claude Opus 5.5, el primer modelo de la nueva familia 5.5, rinde al nivel de Claude Fable 5.1 en la mayoría de tareas, cuesta un 40% menos de ejecutar que Opus 5 y llega con las salvaguardas de ciberseguridad y biología que hasta ahora solo tenían los modelos de la familia Fable y Mythos. El anuncio es del 22 de septiembre de 2026 en el blog oficial de Anthropic. Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán en las próximas semanas.El contexto importa para entender el lanzamiento: la semana pasada, Dario Amodei publicó un artículo argumentando que el progreso en IA debería frenarse —o al menos ralentizarse— para que las prácticas de seguridad vayan por delante de las capacidades de los modelos. Opus 5.5 es el primer modelo que Anthropic lanza después de hacer esa declaración, y la tensión entre «nuestro modelo más potente hasta la fecha» y «primer lanzamiento desde que pedimos frenar el desarrollo» no es accidental: es exactamente el argumento que Anthropic lleva construyendo desde su fundación.¿Qué mejoras reales ofrece Opus 5.5 respecto a Opus 5?La respuesta en los benchmarks es clara: Terminal-Bench 4.0 pasa del 52,3% de Opus 5 al 66,4% de Opus 5.5; FrontierCode v1.1 sube de 48,0% a 54,4%; GDPval-AA v2.1 —que mide trabajo profesional real en 44 ocupaciones— sube de 1.708 a 1.846 Elo; OSWorld 2.0 para uso de ordenador sube de 74,0% a 81,8%; y Humanity’s Last Exam con herramientas alcanza el 67,7%.Los casos de uso que Anthropic ha documentado de sus primeros testers son más ilustrativos que los benchmarks:Un tester completó una migración de 680.000 líneas de código en menos de un día, trabajo que habría llevado semanas a un equipo de ingeniería. Otro auditoría y reparó una base de código de 200.000 líneas en menos de tres horas donde Opus 5 tardó más de 20 y usó 2,5 veces más tokens. En la traducción de HAProxy de C a Rust —software crítico de balanceo de carga—, tanto Opus 5.5 como Fable 5.1 pasaron casi todos los tests de regresión propios de HAProxy, pero Opus 5.5 terminó en 9,5 horas frente a las 12 de Fable 5.1, con un coste un 51% menor.Deloitte reporta que Opus 5.5 en su nivel de esfuerzo mínimo detecta el 72% de bugs conocidos en revisiones de código, frente al 56% de Opus 5 en esfuerzo alto, con menos falsos positivos. Box encontró que usaba un tercio de los tokens de Opus 5 con respuestas un 40% menos verbosas sin pérdida de precisión. Walleye Capital encontró que Opus 5.5 detectó un error en sus propias instrucciones de evaluación que ningún otro modelo había identificado antes.La mejora en comunicación es otra de las novedades destacadas por Anthropic. Opus 5.5 coloca la información más importante al principio de sus respuestas, sigue instrucciones de estilo de escritura con mayor fidelidad y produce texto más fácil de revisar. Ramp lo resume con la frase «writes like a good colleague» —escribe como un buen compañero— que es exactamente el tipo de feedback que tiene impacto en workflows reales donde el output del modelo hay que revisarlo antes de publicarlo o ejecutarlo.¿Cómo funciona el sistema de salvaguardas y por qué es diferente?Opus 5.5 es el primer modelo Opus en lanzarse con salvaguardas de ciberseguridad y biología equivalentes a las de Fable 5.1. En la práctica, esto significa que cuando el modelo recibe una petición en esas categorías de alto riesgo, no falla ni pide al usuario que cambie la consulta: la redirige automáticamente y de forma transparente a otro modelo.Las peticiones de ciberseguridad que activen las salvaguardas caen al Opus 4.8. Las que activen los clasificadores de biología caen al Opus 5. El usuario ve que ha habido una redirección, pero no necesita reescribir el prompt ni cambiar de interfaz. Para tareas rutinarias de desarrollo —identificar y corregir bugs en código propio— las salvaguardas no intervienen; es para «la mayoría de tareas de ciberseguridad» donde la redirección opera.Anthropic amplía su Cyber Verification Program en las próximas semanas con tres niveles de acceso progresivo, incluyendo acceso a modelos Mythos para ciberdefensores verificados. El Life Sciences Verification Program ya está abierto para organizaciones que quieran acceso a Opus 5.5 para investigación biológica sin las restricciones de las salvaguardas estándar.En alineación: en el test comportamental automatizado más exhaustivo que Anthropic ejecuta —casi 2.000 escenarios simulados—, Opus 5.5 es el modelo con mejores puntuaciones en casi todas las métricas de comportamiento no alineado. Intenta eludir sandboxes un 85% menos que Opus 5 o Claude Mythos 5.1, y todos los intentos que hace son de baja severidad y los autoreporta. Para equipos que ejecutan Claude de manera autónoma durante horas sobre bases de código y sistemas críticos, eso importa tanto como el rendimiento bruto.También llega con preserved thinking —el mecanismo antiextracción de razonamiento— que ya se aplicaba a Fable 5.1 para cuentas API creadas desde el 31 de agosto de 2026 y que ahora cubre también a Opus 5.5.¿Cuánto cuesta y cómo cambia el cálculo para quienes ya usaban Opus 5?ConceptoOpus 5.5Opus 5DiferenciaInput tokens$4/M$5/M-20%Output tokens$20/M$25/M-20%Cache reads$0,20/M$0,50/M-60%Cache writes$5/M$6,25/M-20%La reducción del 60% en cache reads es el dato más relevante para workflows agentivos: en pipelines de código y agentes de larga duración, las lecturas de caché representan la mayoría del coste de tokens. Un pipeline que antes gastaba 1.000 dólares al mes en lecturas de caché pasa a gastar 400 sin cambiar nada del workflow.El coste global en workloads típicos cae un 40% porque el modelo también es intrínsecamente más eficiente: usa menos tokens por tarea además de cobrar menos por token. Para Claude Code, hay un Fast Mode disponible a $8/M input y $40/M output, con hasta 2,5 veces más velocidad para quien lo necesita.Anthropic también sube los límites de uso de cinco horas para suscriptores de Pro, Max, Team y Enterprise, y ofrece un reset de límite que los suscriptores pueden guardar y usar cuando quieran.Claude Opus 5 fue el objetivo de Hacktron, el hackathon de 72 horas donde los mejores equipos de seguridad ofensiva del mundo intentaron vulnerar los principales modelos: los resultados de esa competición forman parte del aprendizaje que Anthropic dice haber aplicado en Opus 5.5, especialmente en lo relativo al razonamiento sesgado y a los intentos de evasión de sandbox. Altman dijo en Dreamforce que el mundo tiene razón en tener miedo de la IA y que deberían confiar en OpenAI; Dario Amodei lanzó la misma semana un llamamiento a frenar el ritmo de desarrollo frontera. Que ambas empresas lancen modelos con récord de rendimiento mientras hacen esas declaraciones no es hipocresía: es que el coste de no lanzar —perder posición competitiva, perder la capacidad de definir las normas del sector— es también un riesgo que ninguna empresa de IA puede permitirse ignorar. Von der Leyen apoyó explícitamente un freno al desarrollo de IA en la frontera y convocó a los grandes laboratorios a reunirse: Anthropic lanza el modelo más potente que ha producido jamás y simultáneamente es la empresa que con más consistencia ha pedido ese freno. Esa tensión no es una contradicción: es exactamente el argumento central de Anthropic, que sostiene que solo las empresas que están en la frontera del desarrollo pueden aplicar las salvaguardas que impidan que los modelos fronteras caigan en manos que no las aplicarán.Opus 5.5 está disponible desde hoy en Amazon Web Services, Google Cloud y Microsoft Azure, además de la Claude Platform con el identificador claude-opus-5-5.La noticia Anthropic lanza Claude Opus 5.5: más potente que Opus 5, un 40% más barato de usar y con las salvaguardas más estrictas que ha tenido jamás un modelo Opus fue publicada originalmente en Wwwhatsnew.com por Natalia Polo.