Claude Opus 5.5: 8 tips para aprovecharlo en Claude Code y ahorrar tokens

Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026 y, junto con el modelo, publicó guías oficiales sobre cómo sacarle provecho: la guía de prompting para Opus 5.5 y el artículo Getting the most out of Opus 5.5 in Claude and Claude Code.

Si usas Opus 5.5 y quieres aprovecharlo al máximo, ahorrar tokens o simplemente no desperdiciarlos, aquí tienes un resumen de los puntos más importantes de esas guías, junto con lo que he visto usándolo en la práctica.

Tabla de contenidos

1. Claude Code ya lee AGENTS.md

Muchos tenemos un archivo CLAUDE.md con las reglas del proyecto. El problema era que casi todas las demás herramientas (Codex, Cursor, VS Code y otras) usan el estándar AGENTS.md. Si querías compartir las mismas reglas entre herramientas, tenías que duplicar el archivo y mantener dos copias sincronizadas.

Desde Claude Code 2.1.277 (18 de septiembre de 2026), Claude Code soporta AGENTS.md. Estos son los detalles:

  • Si una carpeta no tiene CLAUDE.md, Claude Code busca y usa AGENTS.md.
  • Si existen ambos, por defecto tiene prioridad CLAUDE.md.
  • Puedes cambiar este comportamiento en /config, en la opción de instrucciones del proyecto. Por ejemplo, claude-md-and-agents-md carga los dos archivos.
  • Un archivo CLAUDE.local.md también cuenta como CLAUDE.md, así que bloquea la lectura de AGENTS.md salvo que actives la opción de cargar ambos.

En la práctica, lo ideal es quedarte con un solo archivo: elimina el CLAUDE.md duplicado y deja solo AGENTS.md. Este archivo se carga en cuanto abres una sesión. Para comprobarlo, puedes preguntarle al agente por alguna de tus reglas. En mi caso tengo una regla de no verificar la compilación en cada cambio, y en una sesión nueva Claude me confirmó que el AGENTS.md del proyecto lo indica explícitamente.

2. Elige el nivel de esfuerzo adecuado

El nivel de esfuerzo (effort) controla cuánto razona el modelo antes de responder. En Opus 5.5 el valor por defecto es medium, un nivel por debajo de Opus 5, cuyo valor por defecto era high. Esta es la guía oficial de Claude Code:

Nivel Cuándo usarlo
low Intercambios rápidos que revisas tú: brainstorming, un primer boceto de interfaz, cambios pequeños como renombrar
medium El trabajo diario con alcance claro, como implementar una feature. Es el valor por defecto en Opus 5.5
high Cuando la verificación importa o hay casos borde, por ejemplo corregir un bug en un proyecto existente
xhigh Razonamiento más profundo con mayor gasto de tokens; tareas largas y complejas
max Problemas difíciles que quieres que resuelva sin ti, como buscar vulnerabilidades de seguridad. Puede tener rendimientos decrecientes y tiende a pensar de más

Para cambiarlo, escribe:

/effort          # abre el selector
/effort high     # lo fija directamente

¿Y ultracode?

En el selector también aparece ultracode. Técnicamente no es un nivel de esfuerzo, sino un modo de Claude Code que usa esfuerzo xhigh y además lanza workflows dinámicos con varios subagentes para cada tarea importante. Es como correr varias sesiones de xhigh en paralelo que verifican distintas partes. Ojo: puede consumir muchos más tokens que trabajar la misma tarea en una sola conversación.

¿Cuánto mejora Opus 5.5?

Según Anthropic, Opus 5.5 con su esfuerzo por defecto (medium) rinde al nivel de Claude Fable 5.1 en la mayoría de las tareas, y en benchmarks como Terminal-Bench supera incluso a Fable 5.1 en esfuerzo máximo. Además, en las pruebas de Anthropic, Opus 5.5 en medium iguala o supera a Opus 5 en high en tareas de código.

Por eso, para el trabajo diario medium suele ser suficiente. La recomendación oficial es empezar en medium y comparar distintos niveles con tus propias tareas, porque lo que funciona mejor depende de tu proyecto. Prueba medium y high en tu caso real y quédate con el que responda mejor.

3. Cambiar de esfuerzo ya no rompe la caché

Cuando trabajas en una sesión larga, Claude reutiliza lo que ya procesó mediante el prompt caching: lo que se lee desde caché cuesta mucho menos que volver a procesar toda la conversación. Con /context puedes ver cuánto contexto ocupa tu sesión actual.

Antes, si cambiabas el nivel de esfuerzo a mitad de una sesión (por ejemplo, de xhigh a max), se invalidaba esa caché y se volvía a cobrar el contexto desde el principio. Con Opus 5.5, cambiar el esfuerzo a mitad de sesión ya no rompe la caché si usas Claude Code v2.1.280 o superior. Si en algún caso Claude Code te muestra un aviso de caché al cambiar el esfuerzo, léelo antes de confirmar.

Un consejo extra del blog de Claude: elige el modelo al inicio de la sesión en lugar de cambiarlo a mitad, y compacta la conversación antes de dejarla en pausa, no después.

4. Resets de uso y créditos para sesiones en la nube

Resets de uso

Igual que ha hecho OpenAI con Codex, Anthropic empezó a dar resets de límites de uso. Con el lanzamiento de Opus 5.5, los usuarios de Pro, Max y Team recibieron un reset que puedes guardar y usar cuando quieras. Si se te acaba el uso de tu suscripción, entras en Settings › Usage › Resets y pulsas Reset for free. Tiene fecha de vencimiento (22 de octubre de 2026), así que úsalo antes.

Anthropic también aumentó los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise por asiento.

Créditos para Claude Code en la nube

Además, Anthropic está regalando créditos promocionales para sesiones de Claude Code en la nube: $100 para Pro y $250 para Max. Las sesiones en la nube ya existían: pides un cambio sobre un repositorio, se ejecuta en los servidores de Anthropic y recibes un pull request. Lo nuevo son los créditos, que funcionan aparte de tu suscripción y solo sirven para esas sesiones.

  • Fecha límite para reclamarlos: 7 de octubre de 2026.
  • Vencen el 4 de noviembre de 2026.

5. Usa /fast cuando necesites velocidad

Opus 5.5 ya es bastante rápido; según Anthropic, genera salida más de un 30% más rápido que Opus 5. Si necesitas respuestas todavía más rápidas, por ejemplo al iterar o depurar en vivo, existe el modo rápido:

/fast

Este modo usa el mismo modelo con la misma calidad, pero responde hasta 2,5 veces más rápido a un precio mayor por token ($8/$40 por millón de tokens de entrada/salida en Opus 5.5). En planes de suscripción no entra en el límite de tu plan: se paga con créditos de uso (usage credits), que debes activar en Settings › Usage. Si no los tienes activados, /fast te lo indicará.

Consejo: si lo vas a usar, actívalo al inicio de la conversación. La primera vez que lo activas se cobra todo el contexto acumulado a precio de fast mode, así que activarlo tarde sale más caro.

6. Dale un límite de tiempo

Opus 5.5 respeta bastante bien los límites de tiempo. Si le das un presupuesto, organiza el trabajo para no pasarse:

Haz un review y quita el código que no se esté usando en el proyecto.
Tienes máximo 5 minutos.

La guía de prompting de Anthropic recomienda justamente darle un presupuesto de tiempo cuando puedes estimar cuánto debería tardar la tarea.

7. Define cuándo está terminada la tarea

En tareas largas, lo más importante es decirle al modelo qué significa "terminado". Es algo muy parecido a lo que haces con un loop, donde tienes que marcar bien la condición de salida. El artículo de Anthropic lo resume así: da la tarea completa en un mensaje, nombra la línea de meta y déjalo trabajar.

Un ejemplo basado en el de Anthropic:

Migra los endpoints de pagos del cliente antiguo al cliente nuevo.

Terminado significa: cada endpoint usa el nuevo cliente, el cliente antiguo
está eliminado y toda la suite de tests pasa.

Detente y pregúntame solo si un test falla por una razón que no puedas explicar.

La línea clave es la de "Terminado significa…". También puedes añadir condiciones de parada, como la última línea, para que te consulte solo cuando realmente te necesita.

8. Ya no necesitas decir "piensa paso a paso"

Con Opus 5.5 ya no hace falta pedirle "piensa cuidadosamente", "piensa paso a paso" o "piensa profundamente". Según Anthropic, el modelo siempre piensa antes de responder y decide cuánto pensar. El control principal es el nivel de esfuerzo que hayas elegido. Si tienes esas frases en tus prompts o en tu AGENTS.md, puedes eliminarlas.

Conclusión

Son tips sencillos que puedes aplicar a diario:

  • Unifica tus instrucciones en AGENTS.md.
  • Usa medium como punto de partida y sube el esfuerzo solo cuando tus pruebas lo justifiquen.
  • Cambia de esfuerzo sin miedo a perder la caché (v2.1.280+).
  • Aprovecha el reset de uso y los créditos para la nube antes de que venzan.
  • Usa /fast solo cuando la velocidad importe más que el costo.
  • Dale un tiempo máximo y define claramente cuándo termina la tarea.

Fuentes y lecturas recomendadas:

Preguntas frecuentes

¿Qué nivel de esfuerzo debo usar con Opus 5.5 en Claude Code?

Empieza con medium, que es el valor por defecto y cubre el trabajo diario. Sube a high para bugs o tareas donde la verificación importa, y reserva xhigh o max para tareas largas o muy complejas. Lo ideal es comparar niveles con tus propias tareas.

¿Claude Code lee AGENTS.md?

Sí, desde la versión 2.1.277. Si no hay CLAUDE.md en la carpeta, usa AGENTS.md. Si existen ambos, prioriza CLAUDE.md salvo que configures en /config que cargue los dos.

¿Cambiar el esfuerzo a mitad de sesión gasta más tokens?

Con Opus 5.5 y Claude Code v2.1.280 o superior, cambiar el esfuerzo no invalida la caché del prompt. Cambiar de modelo a mitad de sesión sí puede hacerlo, así que conviene elegirlo al inicio.

¿El modo /fast está incluido en mi suscripción?

No. En planes Pro, Max, Team y Enterprise se paga con créditos de uso, aparte de los límites del plan.

¿Qué es ultracode?

Es un modo de Claude Code que combina esfuerzo xhigh con workflows dinámicos de varios subagentes. Es potente para tareas grandes, pero consume muchos más tokens.


¿Tienes dudas o algún tip que quieras compartir? Déjalo en los comentarios del video. Y si necesitas ayuda con tu proyecto, en fazt.dev puedes reservar asesorías personalizadas.