Delegar a uno solo no es delegar

Llevo años liderando equipos y creía que delegar lo tenía resuelto. Los agentes de código me mostraron que no, y lo hicieron en una tarde.

El error fue este: tenía una tarea grande, lancé un subagente para que la hiciera y me quedé esperando el resultado.

Se sentía como delegar. No lo era.

Qué pasa realmente cuando lanzas uno solo

El agente principal delega y se queda esperando. No avanza en paralelo, no hace nada mientras tanto. El reloj corre igual que si hubiera hecho la tarea él mismo, más el costo de coordinar.

Y ese costo no es cero:

El subagente parte en frío. No tiene la conversación, ni los archivos que ya se leyeron, ni las decisiones que ya se tomaron. Lo primero que hace es reconstruir contexto que el principal ya tenía.

Devuelve un resumen, no su razonamiento. El principal termina actuando sobre una versión comprimida de un trabajo que podría haber hecho con toda la información a mano.

Pagas dos veces. Tokens para que el subagente rearme el contexto, más tokens para que el principal lea el informe.

Sumado: más lento, más caro y con menos información que hacerlo directo.

Cuándo sí vale la pena

Dos casos, y conviene no confundirlos.

Paralelismo real. Dos o más tracks que avanzan al mismo tiempo y que se pueden completar sin los resultados de los otros. Si el track B necesita lo que produjo el track A, no son paralelos: son una fila, y la fila va en el agente principal.

Aislamiento de contexto. Acá está la excepción honesta a la regla, y es la parte que casi nunca se dice: un subagente solo sirve cuando lo que quieres es que el ruido no entre a tu contexto. Buscar algo entre doscientos archivos y recibir solo la conclusión es un uso legítimo, aunque no ganes ni un segundo.

La distinción que importa: el paralelismo te da velocidad, el aislamiento te da foco. Si lanzaste un subagente esperando velocidad y solo tenías uno, no ibas a recibir velocidad.

La regla, como quedó escrita

Usa 2 o más subagentes, o ninguno. Nunca exactamente uno: principal más uno
es secuencial, no paralelo.

Lanza todos los subagentes en una sola respuesta. Cada track debe poder
completarse sin los resultados de los otros; el trabajo dependiente se queda
en el principal.

Excepción: uno solo se justifica para aislar contexto, nunca para ganar
velocidad.

Esa última línea llegó después, cuando entendí por qué la regla original me incomodaba. Una regla que no puedes defender es una regla que vas a romper mal.

El error no era técnico

Lo incómodo vino después, cuando reconocí el patrón fuera del terminal.

Delegar una tarea y quedarte encima supervisando cada paso no es delegar: es hacer el trabajo con un intermediario. Sale más lento que hacerlo tú, cuesta más y terminas decidiendo sobre un resumen en vez de sobre los hechos.

Lo había hecho durante años con personas. Necesité verlo en un agente, donde el costo aparece medido en segundos y en tokens, para reconocerlo.

Los agentes no me enseñaron a delegar. Me mostraron una factura que con personas siempre había podido ignorar.

El archivo

Esta es una regla de nueve. El resto —límites, convenciones, verificación, seguridad— está en el CLAUDE.md base que dejo gratis, cada una con el fallo concreto que previene.

Te lo dejo acá: el CLAUDE.md base comentado.

Si vas a copiar solo una regla, que sea esta. Es la que más tiempo me devolvió.

Artículos relacionados