Anthropic anuncia Claude Opus 5: Mejoras en el rendimiento sin subir de precio por token
Lidera programación agéntica, ciencia aplicada y estabilidad entre ejecuciones sucesivas. | Creada con IA.

Anthropic anuncia Claude Opus 5: Mejoras en el rendimiento sin subir de precio por token

Anthropic presentó Claude Opus 5 como su nuevo modelo para programación agéntica, investigación, trabajo de conocimiento y uso de computadores en tareas prolongadas. La compañía mantiene las tarifas de Opus 4.8, lo incorpora como opción predeterminada en Claude Max y lo ofrece como su modelo más capaz para suscriptores de Claude Pro.

Claude Sonnet 5 apunta a agentes de IA para empresas
Anthropic acerca funciones agente, codificación y uso de herramientas a equipos que buscan más autonomía operativa con control de costos y seguridad

Claude Opus 5 lidera varias pruebas de rendimiento

El modelo obtuvo 43,3% en Frontier-Bench v0.1, por encima de GPT-5.6 Sol con 34,4%, Fable 5 con 33,7% y Opus 4.8 con 21,1%. En GDPval-AA v2 alcanzó 1.861 puntos y en ARC-AGI-3 llegó a 30,2%, frente al 7,8% informado para GPT-5.6 Sol.

Claude Opus 5 también encabezó BrowseComp con 90,8%, OSWorld 2.0 con 70,6% y AutomationBench con 26%. No lideró todas las mediciones, pues GPT-5.6 Sol obtuvo 72,7% en DeepSWE v1.1 y Fable 5 registró una ventaja mínima en FrontierCode v1.1.

Claude Opus 5 frente a Fable 5, Opus 4.8 y GPT-5.6 Sol en evaluaciones de programación, razonamiento, búsqueda, uso de computadores y flujos profesionales. | Créditos: Anthropic

Scott Wu, CEO de Cognition, evaluó Claude Opus 5 dentro de Devin y destacó su comportamiento en tareas complejas de programación. Su observación se centró en la depuración difícil y en la identificación de las causas que originan los errores.

“En FrontierCode 1.1, Claude Opus 5 se aproxima al rendimiento de Fable por la mitad del costo. [...] También muestra una fortaleza particular en tareas difíciles de depuración y análisis de causa raíz”.

Sualeh Asif, cofundador de Cursor, comparó el modelo con Fable 5 a partir de sus evaluaciones internas. Según su análisis, Opus 5 conserva la velocidad y el costo de la familia Opus mientras reproduce varios comportamientos del modelo superior.

“Claude Opus 5 ofrece una inteligencia cercana a Fable 5 con la velocidad y el costo de Opus. [...] En CursorBench se ubica apenas por debajo de Fable 5 y presenta muchos de los mismos comportamientos”.
AMD y Anthropic desplegarán hasta 2 GW con GPU para IA
La alianza incluye sistemas Helios con GPU Instinct MI455X, una inversión de hasta US$5 mil millones y el uso de Claude para acelerar el software ROCm

Claude Opus 5 amplía su alcance científico

Anthropic también reportó avances en ciencias de la vida frente a Opus 4.8, con una mejora de 10,2 puntos porcentuales en química orgánica. En tareas relacionadas con proteínas, la diferencia informada llegó a 7,7 puntos porcentuales.

Alfredo Andere, CEO de LatchBio, evaluó Claude Opus 5 en flujos de análisis genómico que requieren seleccionar pruebas estadísticas y revisar resultados. Su valoración destacó la capacidad del modelo para descartar factores de confusión y sostener análisis extensos de varios pasos.

“En nuestro trabajo de análisis genómico, Claude Opus 5 se comporta más como un científico cuidadoso que cualquier modelo que hayamos utilizado. [...] Contrasta sus propios resultados mediante métodos independientes y mantiene el rumbo durante análisis largos de múltiples pasos”.
Anthropic propone una escala para medir jailbreaks de IA en ciberseguridad
Fable 5 aplica filtros más conservadores en ciberseguridad y plantea una escala para clasificar jailbreaks según gravedad y uso operativo

Fabian Hedin, cofundador de Lovable, centró su evaluación en las tareas más exigentes de programación agéntica y en la estabilidad entre ejecuciones. La empresa observó una mejora frente a Opus 4.7 y una menor variación en resultados sucesivos.

“Claude Opus 5 quedó por delante de todos los modelos de su familia en nuestras evaluaciones internas. [...] Mejoró 22% frente a Opus 4.7 y es más estable, con mucha menos variación entre ejecuciones. [...] Resultados confiables, una creación tras otra”.

Claude Opus 5 está disponible mediante la API por USD 5 por millón de tokens de entrada y USD 25 por millón de tokens de salida. El modo Fast entrega una ejecución cercana a 2,5 veces más rápida y duplica el precio base del modelo.