JOURNAL / 2026.07.26
Anthropic lanza Claude Opus 5 para agentes y programación
Opus 5 acerca el rendimiento de Fable 5 al precio de Opus 4.8 y apuesta por agentes más constantes, capaces de revisar su trabajo y sostener tareas largas.
Anthropic lanzó el 24 de julio Claude Opus 5, su nuevo modelo de gama alta para uso cotidiano. La comparación importante no es con una ruta concreta de nube, sino con los otros dos escalones de la familia: Anthropic afirma que Opus 5 se acerca a la capacidad de Fable 5 en muchas tareas, cuesta aproximadamente la mitad por trabajo y mantiene el precio de Opus 4.8, su predecesor. Está disponible en los planes de pago, Claude Code y la API por 5 dólares el millón de tokens de entrada y 25 dólares el millón de salida.
La propuesta resulta interesante porque la mejora no se presenta sólo como «más inteligencia». Opus 5 incorpora niveles de esfuerzo para intercambiar coste y profundidad, y Anthropic lo describe como más constante al verificar resultados, corregir errores y continuar hasta completar trabajos largos. Esa combinación apunta a un problema central de los agentes actuales: no basta con resolver un paso difícil; deben conservar el objetivo, detectar cuándo su estrategia falla y revisar lo construido antes de entregarlo.
Los benchmarks ayudan aquí, aunque necesitan contexto. En las pruebas publicadas por Anthropic, Opus 5 más que duplica el resultado de Opus 4.8 en Frontier-Bench con menor coste por tarea. En CursorBench, a esfuerzo máximo, queda a medio punto porcentual del mejor resultado de Fable 5 por aproximadamente la mitad del coste. También lidera las comparaciones mostradas para uso de ordenador y automatización empresarial. Son señales coherentes de una mejora en trabajo agentivo, pero no equivalen a una garantía general: varias mediciones proceden del propio proveedor, usan arneses y presupuestos concretos, y algunas permiten que otro modelo intervenga cuando un clasificador bloquea una petición.
Más reveladores que una cifra aislada son los tipos de fallo que Anthropic dice haber observado. En sus ejemplos, Opus 5 encuentra causas raíz que otros modelos confunden con síntomas, construye herramientas auxiliares cuando carece de una vía directa para validar el resultado y mantiene cambios grandes en un repositorio sin perder el hilo. Los testimonios de acceso anticipado insisten además en menor variación entre ejecuciones y mejor juicio antes de publicar código. Todo ello sigue siendo evidencia seleccionada para un lanzamiento, pero señala qué debería comprobar un equipo: no sólo cuántos problemas resuelve, sino cuántas veces entrega algo verificable sin que una persona tenga que reconstruir el proceso.
El salto parece especialmente significativo por eficiencia. Fable 5 continúa siendo el modelo de Anthropic para los proyectos más autónomos y prolongados, mientras que Opus 5 busca llevar una parte de esa capacidad a un precio y una latencia más utilizables cada día. Si esa relación se sostiene fuera de los benchmarks del proveedor, el cambio práctico puede ser mayor que una subida de puntuación: tareas que antes exigían reservar el modelo más caro podrían pasar a un nivel suficientemente bueno para integrarse de forma habitual en programación, análisis y automatización.
Anthropic también presenta Opus 5 como su modelo más alineado hasta ahora y afirma que muestra menos conducta engañosa o temeraria que Opus 4.8, Sonnet 5 y Fable 5. Al mismo tiempo, reconoce que su capacidad general ha mejorado en ciberseguridad aunque no fuera entrenado específicamente para ello, y aplica clasificadores adicionales a algunas tareas. Es una tensión razonable: un agente más capaz de insistir, improvisar y recuperarse también exige límites que observen la trayectoria completa, no sólo cada acción por separado.
Mi lectura es que Opus 5 importa menos por destronar a un modelo en una tabla que por estrechar la distancia entre el mejor rendimiento disponible y el que resulta viable usar con frecuencia. La pregunta decisiva será si su aparente constancia sobrevive a repositorios desordenados, herramientas reales, requisitos ambiguos y sesiones de muchas horas. Ahí se distingue un modelo que produce demostraciones impresionantes de uno que empieza a ser una pieza fiable de trabajo.
Opus 5 también está disponible mediante Amazon Bedrock y otras plataformas, pero eso es distribución, no el núcleo del lanzamiento. Las condiciones de retención, residencia y controles cambian según la ruta elegida y deberán revisarse al desplegarlo; primero, sin embargo, conviene entender qué modelo se está distribuyendo y por qué su combinación de capacidad, coste y autonomía merece atención.
Fuentes
- Anthropic, Introducing Claude Opus 5, 24 de julio de 2026.
- Anthropic, Claude Opus 5 System Card, julio de 2026.
- AWS, Claude Opus 5 is now available on AWS, 24 de julio de 2026.