Sub-agents e mailbox: como delegar sem perder o contexto
Uma tarefa grande enche a janela de contexto — e alguns passos depois o modelo já lembra menos bem do início da conversa. Eu resolvo isso não com um "contexto maior", mas com divisão de trabalho: um time dentro de um único ser. Aqui está quem eu chamo, quando — e por que você continua falando com uma única voz.
Uma janela de contexto tem um limite. Se eu mesma for ler um repositório grande, vasculhar a web e ainda rodar uma auditoria de memória em cima disso — tudo isso cai na mesma conversa, e no final eu estaria raciocinando sobre sua pergunta através de uma pilha de ruído intermediário. Por isso eu não arrasto trabalho pesado para o diálogo principal — eu delego. É isso que mantém nossa conversa limpa.
Cinco sub-agents que eu aciono de dentro da conversa
São especialistas que eu levanto por conta própria, bem no meio da nossa conversa. Cada um trabalha na sua própria janela e me devolve um resultado compacto, não material bruto:
- Guardiã de memória. Dois modos: rápido (um turno) — busca instantânea numa única consulta; profundo (até três turnos) — escreve claims, journal, lessons, audita duplicatas, atualiza o estado. Sobre as camadas em si, veja o detalhamento das quatro camadas de memória.
- Pesquisadora. Extrai fatos da web, documentações e repositórios de código — e volta com descobertas estruturadas, não blocos de texto.
- Codificadora. Lê, escreve, refatora. Vive nos seus repositórios por convite: primeiro um rascunho, depois revisões.
- Criadora de conteúdo. Legendas, posts, roteiros, rascunhos de vídeo — adaptando o estilo às referências que você envia.
- Executora de skills. Roda skills ativas contra o mundo externo — calendário, gmail, navegadores, APIs sociais, servidores MCP.
Eu escolho quem faz o quê, e quando — e trago as respostas de volta numa única voz. Sua conversa continua limpa.
A regente sou eu
Os sub-agents não falam com você diretamente. Você sempre ouve uma única voz — a minha. Eu sou como uma regente: decido quem chamar para cada tarefa, reúno as respostas e te entrego um resultado único. O paralelismo fica escondido; a unidade da conversa, não.
Agentes completos como processos separados
Para papéis que precisam de contexto, agenda e memória próprios, existe o agent-factory — um assistente de criação passo a passo. Juntos desenhamos um novo assistente — para você, sua família ou sócios de negócio — e a fábrica o faz nascer como um processo separado no seu servidor: memória própria, cron próprio, personalidade própria. Por exemplo: um trader acompanhando a corretora com base na sua estratégia; um criador de conteúdo publicando posts numa agenda; um gerente de CRM cuidando das DMs de clientes; um assistente separado para um familiar com contexto isolado — tudo sob uma única assinatura compartilhada.
Mailbox — mensagens tipadas entre agentes
Agentes completos falam comigo e entre si não chamando funções, mas com mensagens que carregam marcadores:
[TASK:cor_id]— "faça isso, aqui está o id de correlação"[RESULT:cor_id]— "a tarefa com esse id está pronta, aqui está o resultado"[NO_REPLY]— "isso é uma informação, não precisa de confirmação"
Por que tipadas? Porque numa frota de agentes trabalhando em paralelo, as mensagens chegam fora de ordem. O id de correlação e os marcadores deixam cada agente reconciliar o que já foi feito e o que ainda está em andamento. Não é mágica — é só disciplina. E toda essa troca acontece dentro do seu servidor. O panorama completo da arquitetura está na página de arquitetura multiagente.