Anthropic tiene un ritmo claro en 2026: lanza un modelo relevante cada pocas semanas. Opus 5 es el más importante de todos hasta ahora. No por el nombre, sino por los números.
Qué cambió en Opus 5
Lidera en el benchmark que importa para agentes
Frontier-Bench v0.1 es el índice de referencia para tareas agénticas complejas: flujos de múltiples pasos, uso de herramientas, razonamiento encadenado. Opus 5 obtuvo 43.3%. GPT-5.6 Sol llegó a 34.4%. Claude Fable 5, el modelo anterior de gama alta de Anthropic, se quedó en 33.7%.
Ese salto de casi 10 puntos sobre el segundo lugar no es cosmético. Es la diferencia entre un agente que completa tareas largas con intervención mínima y uno que falla en la mitad del camino.
ARC-AGI-3: cuatro veces mejor que la competencia
ARC-AGI-3 mide razonamiento abstracto en problemas que los modelos no han visto antes: sin memorización posible, solo lógica pura. Opus 5 obtuvo 30.2%. GPT-5.6 Sol llegó a 7.8%. Es la brecha más grande registrada entre dos modelos frontier en este benchmark.
Más relevante: Opus 5 resolvió 5 entornos que ningún modelo de IA había resuelto antes, según ARC Prize.
Thinking activado por default
En versiones anteriores, el razonamiento extendido (extended thinking) requería activación manual desde la API. Con Opus 5, está encendido por default. No necesitas configurar nada: el modelo ya razona profundamente antes de responder.
Para equipos que apenas están integrando IA en sus procesos, esto elimina una fricción real. Menos configuración, mejor output desde el primer llamado.
Ventana de contexto de 1 millón de tokens
Opus 5 mantiene la ventana de 1 millón de tokens con salida máxima de 128,000 tokens. En términos prácticos: puede procesar documentos completos, bases de código extensas o conversaciones largas sin perder contexto.
El precio no cambió
Este es el dato que más importa para quienes tienen proyectos en producción: $5 por millón de tokens de entrada, $25 por millón de tokens de salida. Mismo precio que Opus 4.8.
Un modelo radicalmente más capaz al mismo costo de operación. Si ya tienes integraciones con Opus vía API, el upgrade no afecta tu presupuesto.
Dónde está disponible ahora
Opus 5 está disponible en Claude API desde el 24 de julio. También en Claude Pro y Claude Max. El identificador del modelo en la API es claude-opus-5.
Qué significa esto para quien automatiza procesos
Si usas Opus 4.8 vía API
Cambia el model ID. No cambia el precio. El único costo es el tiempo de la prueba: valida que tus prompts funcionen igual o mejor con Opus 5. En la mayoría de los casos, funcionarán mejor, especialmente en flujos largos o con múltiples herramientas.
Si usas Claude Code o agentes complejos
El salto de rendimiento en tareas agénticas es el más relevante del mercado en este momento. Si tienes pipelines donde el agente toma decisiones en secuencia, Opus 5 debería reducir el número de pasos que fallan o requieren reintento.
Si estás evaluando adoptar IA
El mercado tiene ahora tres capas claras: modelos rápidos y baratos para consultas simples (Haiku, Flash), modelos balanceados para tareas cotidianas (Sonnet 5, GPT-5.6 Sol), y modelos de razonamiento profundo para tareas complejas (Opus 5). El precio de entrada a esa tercera capa ya no es prohibitivo.
Lo que no sabemos aún
Anthropic no publicó resultados de Opus 5 en benchmarks de codificación específicos como SWE-bench. Las mejoras documentadas se centran en razonamiento abstracto y tareas agénticas. Para evaluaciones de código puro, espera comparaciones de la comunidad en los próximos días.
Decisión práctica: si tienes acceso a Opus vía API, cambia el model ID esta semana y mide. No hay riesgo de costo adicional y hay ganancia potencial real en calidad de output.