Delegar a uno solo no es delegar
Lancé un subagente para una tarea grande y me quedé esperando. Sentí que delegaba. Estaba haciendo lo mismo, más lento y con menos información. La regla que escribí después, y el error de gestión que llevaba años cometiendo.
Llevo años liderando equipos y creía que delegar lo tenía resuelto. Los agentes de código me mostraron que no, y lo hicieron en una tarde.
El error fue este: tenía una tarea grande, lancé un subagente para que la hiciera, y me quedé esperando el resultado mirando la pantalla, bastante satisfecho conmigo mismo.
Se sentía como delegar, y no lo era.
”Mientras el subagente trabaja, yo avanzo en otra cosa”
Eso es lo que uno cree que está pasando, y no es lo que pasa: el agente principal delega y se queda esperando, no avanza en paralelo, no hace nada mientras tanto, así que el reloj corre igual que si hubiera hecho la tarea él mismo, más el costo de coordinar.
Y ese costo no es cero, ni cerca.
El subagente parte en frío, sin la conversación, sin los archivos que ya se leyeron, sin las decisiones que ya se tomaron, así que lo primero que hace es reconstruir contexto que el principal ya tenía completo.
Después te devuelve un resumen, no su razonamiento, con lo cual el principal termina actuando sobre una versión comprimida de un trabajo que podría haber hecho con toda la información a mano.
Y pagas dos veces: tokens para que el subagente rearme el contexto, más tokens para que el principal lea el informe.
Sumado: más lento, más caro, y con menos información que hacerlo directo.
Cuándo sí vale la pena
Dos casos, y conviene no confundirlos.
Paralelismo real. Dos o más tracks que avanzan al mismo tiempo y que se pueden completar sin los resultados de los otros. Si el track B necesita lo que produjo el track A, esos no son paralelos, son una fila, y la fila va en el agente principal.
Aislamiento de contexto. Acá está la excepción honesta a la regla, y es la parte que casi nunca se dice: un subagente solo sí sirve cuando lo que quieres es que el ruido no entre a tu contexto. Buscar algo entre doscientos archivos y recibir solo la conclusión es un uso legítimo, aunque no ganes ni un segundo.
La distinción que importa: el paralelismo te da velocidad y el aislamiento te da foco. Si lanzaste un subagente esperando velocidad, y solo tenías uno, la velocidad nunca iba a llegar.
La regla, como quedó escrita
Usa 2 o más subagentes, o ninguno. Nunca exactamente uno: principal más uno
es secuencial, no paralelo.
Lanza todos los subagentes en una sola respuesta. Cada track debe poder
completarse sin los resultados de los otros; el trabajo dependiente se queda
en el principal.
Excepción: uno solo se justifica para aislar contexto, nunca para ganar
velocidad.
Esa última línea llegó después, cuando entendí por qué la regla original me incomodaba. Una regla que no puedes defender es una regla que vas a romper mal.
El error no era técnico
Lo incómodo vino después, cuando reconocí el patrón fuera del terminal.
Delegar una tarea y quedarte encima supervisando cada paso no es delegar, es hacer el trabajo con un intermediario: sale más lento que hacerlo tú, cuesta más, y terminas decidiendo sobre un resumen en vez de sobre los hechos.
Lo había hecho durante años con personas. Necesité verlo en un agente, donde el costo aparece medido en segundos y en tokens, para reconocerlo.
Los agentes no me enseñaron a delegar. Me pasaron una factura que con personas siempre había podido ignorar.
El archivo
Esta es una regla de nueve. El resto, límites, convenciones, verificación y seguridad, está en el CLAUDE.md base que dejo gratis, cada una con el fallo concreto que previene.
Te lo dejo acá: el CLAUDE.md base comentado.
Si vas a copiar solo una regla, que sea esta. Es la que más tiempo me devolvió.