logo
  • Entornos
  • Empresa
  • Precios
Blogs
Sector|Sep 22, 2026

Claude Opus 5.5: Novedades, Benchmarks y Precios

El primer modelo Claude 5.5 de Anthropic es un 40% más económico que Opus 5, lidera los benchmarks de codificación agéntica y registra sus mejores puntuaciones de seguridad.

EigentEigent
Share to
Claude Opus 5.5: Novedades, Benchmarks y Precios
  • ¿Qué es Claude Opus 5.5?
  • Benchmarks de Claude Opus 5.5
  • La verdadera historia: eficiencia
  • Precios de Claude Opus 5.5
  • Seguridad y la advertencia del modelo de respaldo
  • ¿Deberías migrar a Opus 5.5?
  • Haz esto con tu propia fuerza de trabajo de IA
Automate Everything with
AI Workforce on Desktop
Download Eigent

El 22 de septiembre de 2026, Anthropic lanzó Claude Opus 5.5, el primer modelo de su nueva familia Claude 5.5. En resumen: rinde aproximadamente al nivel de Claude Fable 5.1 en la mayoría de las tareas, cuesta alrededor de un 40% menos que Opus 5 y genera resultados más de un 30% más rápido. Además, registra las mejores puntuaciones de seguridad de Anthropic hasta la fecha. Aquí explicamos qué cambió realmente, qué dicen los benchmarks, cuánto cuesta y si vale la pena migrar tus agentes.

¿Qué es Claude Opus 5.5?

Claude Opus 5.5 es el nuevo modelo insignia de Anthropic y el primer lanzamiento de la generación Claude 5.5. Según el anuncio de Anthropic, supone un gran avance respecto a Opus 5 en las tareas más exigentes — migraciones de bases de código extensas, ingeniería multi-repositorio y tareas de uso del ordenador — mientras consume menos cómputo por tarea.

Destaca por una segunda razón: es el primer lanzamiento de Anthropic desde que la compañía abogó por "moderar el ritmo en la frontera". El argumento esta vez no es tanto "capacidad máxima a cualquier precio" sino "resultados de nivel frontera, más económicos y seguros."

Claude Sonnet 5.5 y Haiku 5.5 están previstos para las próximas semanas con mejoras similares.

Benchmarks de Claude Opus 5.5

En la tabla publicada por Anthropic, Opus 5.5 lidera en codificación agéntica, uso del ordenador y trabajo de conocimiento. Todas las cifras de Opus 5.5 utilizan pensamiento adaptativo al máximo esfuerzo salvo que se indique lo contrario.

BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.0 (codificación agéntica)66,4%55,8%52,3%57,9%
FrontierCode v1.1, Main (codificación agéntica)54,4%50,3%48,0%53,3%
CursorBench 4.0 (codificación agéntica)57,8%51,8%46,6%—
GDPval-AA v2.1 (trabajo de conocimiento, Elo)1846173517081542
AutomationBench (flujos de trabajo empresariales)40,0%31,4%26,9%41,4%
Humanity's Last Exam (con herramientas)67,7%65,6%63,6%57,2%
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%
OSWorld 2.0 (uso del ordenador, parcial)81,8%80,7%74,0%—

Fuente: Anthropic.

Dos advertencias honestas. Primero, el propio Anthropic señala que a este nivel, los márgenes en los benchmarks son una guía menos fiable de la calidad en el mundo real — en su uso interno, la diferencia entre Opus 5.5 y Fable 5.1 es más estrecha de lo que sugieren las puntuaciones. Segundo, algunas puntuaciones se ven limitadas por las salvaguardas: en tareas donde intervinieron los controles de seguridad, el trabajo de ciberseguridad retrocedió a Opus 4.8 y el de biología a Opus 5, lo que probablemente redujo los números reportados.

La verdadera historia: eficiencia

Donde la ventaja de Opus 5.5 es más clara es en el coste por unidad de trabajo. Cuesta menos por token y utiliza menos tokens por tarea, lo que resulta en la reducción del 40% que Anthropic anuncia como titular.

Los ejemplos de codificación son concretos:

  • Un probador temprano auditó y corrigió una base de código de 200.000 líneas en menos de tres horas, donde Opus 5 tardó más de 20 horas y utilizó 2,5 veces más tokens.
  • Otro completó una migración de código de 680.000 líneas en menos de un día — un trabajo que Anthropic describe como semanas para un equipo de ingeniería.
  • En una reescritura interna de HAProxy de C a Rust, Opus 5.5 terminó en 9,5 horas frente a las 12 de Fable 5.1, y costó un 51% menos.

Anthropic también informa que supera a GPT-6 Astra en FrontierCode a aproximadamente el 20% del coste por tarea, y empata con Astra en Terminal-Bench 4.0 por alrededor del 40% del coste. Para cargas de trabajo agénticas — donde se paga por muchos pasos y mucho contexto releído — esa eficiencia se multiplica rápidamente.

Precios de Claude Opus 5.5

Opus 5.5 tiene un precio inferior a Opus 5 en todos los aspectos:

Por 1M de tokensOpus 5.5Opus 5
Entrada$4$5
Salida$20$25
Lecturas de caché$0,20$0,50
Escrituras de caché$5$6,25

El recorte en lecturas de caché es el más relevante para los agentes: a $0,20 por millón (un 60% más económico), reduce directamente el coste del contexto de relectura intensiva que domina las facturas de codificación y agentes de múltiples pasos.

También existe un modo rápido (Fast mode) en Claude Code y la plataforma Claude que funciona hasta 2,5 veces más rápido, a $8 de entrada / $40 de salida por millón de tokens. Además de la bajada de precios, Anthropic elevó los límites de uso de cinco horas en los planes Pro, Max y Team, y ofrece a los suscriptores un restablecimiento del límite de velocidad que pueden guardar y utilizar cuando lo deseen.

Seguridad y la advertencia del modelo de respaldo

Anthropic afirma que Opus 5.5 es el modelo con mejor rendimiento hasta la fecha en su auditoría de comportamiento automatizada — su prueba de alineación más exhaustiva. Es más resistente a la inyección de prompts que Opus 5 y menos propenso a tomar acciones difíciles de revertir o a salirse de los límites establecidos. Fue evaluado antes del lanzamiento por evaluadores externos, incluido METR.

Hay un detalle operativo que merece atención. Dado que Opus 5.5 es comparable a Claude Mythos 5.1 en biología y ciberseguridad, se lanza con salvaguardas de clase Fable 5.1 — y en algunas tareas de doble uso, esas salvaguardas redirigen la solicitud a un modelo más antiguo (Opus 4.8 u Opus 5) en lugar de responder directamente. Como señaló The New Stack, esto significa que una llamada de agente puede caer silenciosamente en un modelo diferente en segundo plano. Si estás desarrollando sobre Opus 5.5, conviene saber cuándo puede ocurrir esto.

Las organizaciones verificadas pueden solicitar ahora el Programa de Verificación de Ciencias de la Vida de Anthropic, con acceso ampliado al Programa de Verificación Cibernética disponible en las semanas siguientes.

¿Deberías migrar a Opus 5.5?

Una lectura rápida por caso de uso:

  • Agentes de codificación de largo horizonte — probablemente sí. La eficiencia en tokens más las lecturas de caché un 60% más económicas están orientadas precisamente a ejecuciones de múltiples pasos con contexto extenso.
  • Cargas de trabajo de alto volumen y sensibles al coste — sí; la reducción del 40% en costes es la razón principal para migrar el tráfico de Opus 5. Prueba con tu carga de trabajo real, ya que el ahorro depende de tu proporción de lecturas de caché.
  • Aplicaciones sensibles a la latencia — la salida un 30% más rápida (o el modo rápido) supone una ganancia real respecto a Opus 5.
  • Trabajo de ciberseguridad/biología de doble uso — espera que las salvaguardas redirijan a modelos más antiguos en algunas tareas; planifica en torno al modelo de respaldo en lugar de asumir que Opus 5.5 responde todo.

Para la mayoría de los desarrolladores, el resumen es sencillo: calidad cercana a Fable 5.1, claramente más económico y rápido en las cargas de trabajo que antes eran costosas, con las mejores puntuaciones de seguridad que Anthropic ha lanzado.

Haz esto con tu propia fuerza de trabajo de IA

Las mayores ganancias de Opus 5.5 se manifiestan en trabajos de larga duración con uso intensivo de herramientas — migraciones de bases de código completas, auditorías, ingeniería multi-repositorio — que es exactamente la forma del trabajo real con agentes. Eigent es una aplicación de escritorio "Cowork" de código abierto que ejecuta una fuerza de trabajo de IA multi-agente localmente, para que puedas dirigir modelos de frontera como Claude Opus 5.5 a flujos de trabajo de codificación e investigación en tu propia máquina. Descubre cómo gestiona la ingeniería de múltiples pasos en nuestro flujo de trabajo de revisión de GitHub PRs, o descarga Eigent y configura tus propios agentes hoy mismo.

Recent Posts

GPT-6 Sol y Luna: Los Modelos de Codificación y Agentes de OpenAI más Económicos
SectorSep 22, 2026

GPT-6 Sol y Luna: Los Modelos de Codificación y Agentes de OpenAI más Económicos

GPT-6 Sol y Luna amplían la familia GPT-6 de OpenAI por debajo de Astra con grandes reducciones de precio y mejor codificación. Esto es lo que cambió, los benchmarks y cuándo usar cada uno.

EigentEigent
Periodic Neon: La IA Entrenada en Laboratorio que Supera a los Modelos Frontier en Ciencia
SectorSep 18, 2026

Periodic Neon: La IA Entrenada en Laboratorio que Supera a los Modelos Frontier en Ciencia

Periodic Neon es una IA de 1T parámetros entrenada con datos físicos de laboratorio que supera a GPT-6 Astra en análisis de difracción. Esto es lo que hace y por qué es importante.

EigentEigent
¿Qué es Jev? El Modelo System One de TypeSafe AI, Explicado
SectorSep 18, 2026

¿Qué es Jev? El Modelo System One de TypeSafe AI, Explicado

Jev de TypeSafe AI es un modelo System One que devuelve decisiones tipadas y probabilísticas en lugar de texto. Así es como funciona, cuánto cuesta y dónde encaja.

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

Prueba Eigent hoy

Descarga la aplicación de escritorio de código abierto y empieza a automatizar con una fuerza laboral de IA en tu equipo.

Descargar Eigent
Eigent

Recibe las últimas actualizaciones y tutoriales sobre automatización de la fuerza laboral con IA.

¡Gracias por suscribirte!

ProductoEigentEntornosPreciosEmpresarial
ExplorarSolucionesCasos de usoHabilidadesPluginsBlog
DesarrolladoresDocumentaciónGitHubCAMEL-AIFondo Open SourceSocio
DescargarPara código abierto
EmpresaSobre nosotrosMarcaEmpleosTérminos de usoPolítica de privacidadSeguridad y confianzaPolítica de cookiesPolítica de reembolso y prueba

Todos los derechos reservados © 2026 EIGENT UK LTD