Opus 5 redefine cómo presupuestas y diseñas sistemas agenciales. El pensamiento ahora está activado por defecto, por lo que el modelo asigna autónomamente tokens de razonamiento por turno, y el ajuste de esfuerzo se convierte en el principal control de calidad–latencia–costo. A cambio, obtienes análisis multi-paso más estables, mejores ciclos de uso de herramientas a largo plazo y una verificación más sólida sin necesidad de supervisión. Esto también cambia cómo limitas las salidas: max_tokens ahora limita tanto el razonamiento oculto como el texto visible, por lo que los equipos que migran desde 4.8 deben revisar los techos que antes asumían cero tokens de pensamiento.
Dos betas son particularmente importantes para producción: cambios de herramientas en medio de la conversación y el modo de respaldos por defecto. El primero te permite añadir o eliminar herramientas entre turnos sin romper la continuidad del caché, reduciendo la fricción de orquestación y los costos de inicio en frío. El segundo simplifica el manejo de rechazos asignando categorías a respaldos recomendados por Anthropic en lugar de mantener una lista frágil de modelos. Combinado con un mínimo de caché de prompt más bajo y un contexto de 1M tokens, Opus 5 es más adecuado para sesiones prolongadas que combinan recuperación, planificación y delegación multi-agente.
Hay un cambio crítico en el comportamiento: desactivar el pensamiento solo está permitido cuando el esfuerzo es alto o inferior; combinar pensamiento: desactivado con xhigh o max devuelve un error 400. Si debes ejecutar con el pensamiento desactivado, espera un comportamiento más frágil en las llamadas a herramientas y ocasionalmente marcas internas en la salida visible—diseña mitigaciones y pasos de validación en consecuencia. Para todos los demás, la recomendación es mantener el pensamiento activado, comenzar con esfuerzo alto y escalar hacia abajo para mayor rendimiento o hacia xhigh/max para problemas difíciles, con un max_tokens mayor para que el modelo tenga espacio para razonar y actuar.
Prácticamente, esta versión reduce la necesidad de estructuras manuales en los prompts. Opus 5 se auto-verifica con más frecuencia y evita entregables incompletos en trabajos de codificación y documentos de largo plazo. Elimina subagentes verificadores redundantes y “chequeos finales” scriptados, luego vuelve a medir calidad y latencia. Los precios se mantienen en $5/M tokens de entrada y $25/M tokens de salida, con un modo rápido opcional a tarifas premium en la API de Claude. La disponibilidad en las principales nubes permite estandarizar un perfil de razonamiento único mientras se adapta el esfuerzo a niveles de casos de uso—alto para fiabilidad frente al cliente, medio para productividad interna y máximo para análisis avanzados limitados por presupuesto.


