Delegar a uno solo no es delegar
Llevo años liderando equipos y creía que delegar lo tenía resuelto. Los agentes de código me mostraron que no, y lo hicieron en una tarde.
El error fue este: tenía una tarea grande, lancé un subagente para que la hiciera y me quedé esperando el resultado.
Se sentía como delegar. No lo era.
Qué pasa realmente cuando lanzas uno solo
El agente principal delega y se queda esperando. No avanza en paralelo, no hace nada mientras tanto. El reloj corre igual que si hubiera hecho la tarea él mismo, más el costo de coordinar.
Y ese costo no es cero:
El subagente parte en frío. No tiene la conversación, ni los archivos que ya se leyeron, ni las decisiones que ya se tomaron. Lo primero que hace es reconstruir contexto que el principal ya tenía.
Devuelve un resumen, no su razonamiento. El principal termina actuando sobre una versión comprimida de un trabajo que podría haber hecho con toda la información a mano.
Pagas dos veces. Tokens para que el subagente rearme el contexto, más tokens para que el principal lea el informe.
Sumado: más lento, más caro y con menos información que hacerlo directo.
Cuándo sí vale la pena
Dos casos, y conviene no confundirlos.
Paralelismo real. Dos o más tracks que avanzan al mismo tiempo y que se pueden completar sin los resultados de los otros. Si el track B necesita lo que produjo el track A, no son paralelos: son una fila, y la fila va en el agente principal.
Aislamiento de contexto. Acá está la excepción honesta a la regla, y es la parte que casi nunca se dice: un subagente solo sí sirve cuando lo que quieres es que el ruido no entre a tu contexto. Buscar algo entre doscientos archivos y recibir solo la conclusión es un uso legítimo, aunque no ganes ni un segundo.
La distinción que importa: el paralelismo te da velocidad, el aislamiento te da foco. Si lanzaste un subagente esperando velocidad y solo tenías uno, no ibas a recibir velocidad.
La regla, como quedó escrita
Usa 2 o más subagentes, o ninguno. Nunca exactamente uno: principal más uno
es secuencial, no paralelo.
Lanza todos los subagentes en una sola respuesta. Cada track debe poder
completarse sin los resultados de los otros; el trabajo dependiente se queda
en el principal.
Excepción: uno solo se justifica para aislar contexto, nunca para ganar
velocidad.
Esa última línea llegó después, cuando entendí por qué la regla original me incomodaba. Una regla que no puedes defender es una regla que vas a romper mal.
El error no era técnico
Lo incómodo vino después, cuando reconocí el patrón fuera del terminal.
Delegar una tarea y quedarte encima supervisando cada paso no es delegar: es hacer el trabajo con un intermediario. Sale más lento que hacerlo tú, cuesta más y terminas decidiendo sobre un resumen en vez de sobre los hechos.
Lo había hecho durante años con personas. Necesité verlo en un agente, donde el costo aparece medido en segundos y en tokens, para reconocerlo.
Los agentes no me enseñaron a delegar. Me mostraron una factura que con personas siempre había podido ignorar.
El archivo
Esta es una regla de nueve. El resto —límites, convenciones, verificación,
seguridad— está en el CLAUDE.md base que dejo gratis, cada una con el fallo
concreto que previene.
Te lo dejo acá: el CLAUDE.md base
comentado.
Si vas a copiar solo una regla, que sea esta. Es la que más tiempo me devolvió.
Artículos relacionados
Puedes copiar mi estructura. No puedes copiar mis decisiones.
El árbol de archivos de un sistema de contexto se reproduce en una tarde. Lo que sostiene sus resultados son cuatro decisiones que ningún archivo vacío puede tomar por ti.
Un buen prompt sigue siendo una instrucción desechable
Un prompt resuelve una tarea. Para operar trabajo repetible con agentes hacen falta instrucciones, contexto, memoria y un lugar donde guardar el resultado.
Google escribió la especificación de lo que yo hacía mal
El 12 de junio Google Cloud publicó el Open Knowledge Format. Llevo meses operando un sistema de conocimiento en Markdown con el mismo patrón, y la especificación me mostró tres cosas que hice mal. Ninguna es un detalle.