Casi todo el mundo usa su mejor modelo para todo: para pensar, para escribir, para arreglar una coma. Y después se queda sin límite a mitad de semana.
El problema no es que uses el modelo potente. Es que lo estás usando también para las tareas pequeñas, que es donde no aporta nada y donde cuesta más.
La solución es repartir el trabajo:
| Quién lo hace | Qué hace | |
|---|---|---|
| Planear | Tu modelo top | Escribe el plan detallado |
| Ejecutar | Un modelo barato | Implementa el plan tal cual |
| Revisar | Tu modelo top | Compara el resultado contra el plan |
Tu modelo caro solo gasta en las dos cosas que de verdad importan, que son la estrategia y el control de calidad. El barato hace el resto.
Paso uno: cuando abres Claude Code
Corre /model y elige tu modelo más potente, Fable 5 u Opus 5. Configura /effort high para la fase de planeación.
Este modelo escribe el plan y revisa el resultado final. No hace el trabajo operativo.
Paso dos: cuando necesitas alguien que ejecute barato
Crea un subagente que corra en un modelo económico y se encargue de toda la implementación. Puedes pedirle a Claude que lo cree por ti, o crear tú el archivo .claude/agents/executor.md con esto adentro:
---
name: executor
description: Escribe y edita a partir de un plan dado. Úsalo para toda la implementación.
model: haiku
---
Implementas exactamente lo que dice el plan. No lo rediseñes.
Si el trabajo es más difícil, cambia haiku por sonnet.
Paso tres: cuando ya puedes correr el loop
Ahora tu modelo top planea, le pasa el trabajo al ejecutor y lo revisa. Arráncalo con un prompt como este:
Escribe un plan de implementación detallado para [X]. No lo construyas todavía. Luego pásale ese plan al subagente executor para que lo implemente. Cuando termine, revisa tú mismo el resultado contra el plan y corrige lo que haya quedado pendiente.
Cuando quieras que corra solo
Dos comandos más convierten esto en un sistema autónomo.
/goal define la meta final para que siga trabajando hasta cumplir tus criterios, y usa otro modelo más barato para revisar solo si ya terminó. Por ejemplo: "/goal todos los requisitos se cumplen y el código pasa su propia revisión".
/loop y /schedule son los dos modos de repetición. /loop lo re-ejecuta cada cierto intervalo en tu computador. /schedule lo mueve a la nube, para que siga corriendo aunque tu laptop esté cerrada.
Tres ahorros más que casi nadie usa
Baja el esfuerzo cuando el paso es simple. /effort low para las tareas que no requieren pensar.
Limpia entre tareas. /clear entre cosas que no tienen relación entre sí, para que no arrastres contexto que ya no sirve.
Escribe una vez lo que repites siempre. Todo el contexto permanente de tu proyecto va en un archivo CLAUDE.md, y así dejas de explicarle lo mismo cada vez que abres una conversación.
Los errores que va a cometer todo el mundo
Dejar el modelo caro haciendo la implementación. Es lo que pasa si creas el subagente pero después no le pasas el trabajo. Revisa que el plan diga explícitamente que la implementación va al ejecutor.
Poner el esfuerzo alto para todo. /effort high en tareas simples gasta el doble sin mejorar nada.
No limpiar nunca. Arrastrar una conversación de tres horas a una tarea nueva significa pagar por contexto que no tiene nada que ver.
Por dónde empezar
Crea el archivo del subagente hoy, aunque no lo uses todavía. Son cinco líneas y queda listo para siempre en ese proyecto.
Después, la próxima vez que vayas a pedir algo largo, en lugar de pedirlo directo pide primero el plan. Solo con ese cambio, sin tocar nada más, ya vas a notar la diferencia en cuánto te dura el límite.