Distribuí meu trabalho para cinco subagentes de Claude Code e queimei minha janela de uso em menos de uma hora

Claude O código em si é ótimo, mas você usou subagentes? Eles tornam o Claude Code ainda melhor. Usei cinco subagentes do Claude Code, cada um permanece em sua própria janela de contexto, executa uma tarefa específica e retorna apenas um breve resumo junto com alguns metadados.

Eles me ajudam a trabalhar com mais rapidez e eficiência, embora não em termos de uso. Eles são eficazes porque realizam o trabalho com mais rapidez, economizam tempo e fornecem resultados mais completos. Posso dividir um trabalho grande em partes menores, enviá-las em paralelo e concentrar a sessão principal no planejamento, em vez de ficar atolado em logs brutos e longas leituras de arquivos.

Isso é bom. Você pode até dizer que é bom demais. Mas tudo que é bom tem seu obstáculo e, neste caso, é a janela de aplicação. Os limites de uso do Claude Code não são muito generosos no início, mas quando você começa a usar subagentes, eles desaparecem muito mais rápido do que eu esperava.

Subagentes podem fazer muito

E isso muito rapidamente

Um dos maiores motivos para usar subagentes é o isolamento do contexto. Quando você depende de um agente para tudo, sua janela de contexto é preenchida com uma rapidez surpreendente. Cada comando que ele executa ou a resposta que ele gera adiciona mais informações para acompanhar.

Os subagentes ajudam descarregando tarefas maiores. Em vez de pedir a um agente mestre para ler dezenas de arquivos ou vasculhar uma base de código inteira, você pode delegar essas tarefas a subagentes especializados. Eles fazem o trabalho pesado e fornecem um resumo conciso, permitindo que o agente principal se concentre na tarefa que realmente lhe interessa.

Isto se torna ainda mais importante à medida que a janela de contexto aumenta. Quando um agente precisa lidar com muitas informações, as respostas tornam-se menos confiáveis. Ele começará a perder detalhes e a contradizer as respostas anteriores porque está tentando rastrear muitas coisas ao mesmo tempo.

Os subagentes também podem trabalhar em paralelo, o que significa que você não precisa esperar a conclusão de uma tarefa antes de iniciar a próxima. Posso dividir um trabalho grande em várias tarefas menores, enviá-las para diferentes subagentes ao mesmo tempo e combinar os resultados. O Claude Code também oferece suporte ao roteamento dinâmico de modelos, de forma que tarefas mais leves possam ser aplicadas a modelos mais leves, enquanto argumentos mais pesados ​​ficam com os mais fortes.

Percebi o maior benefício dos subagentes enquanto trabalhava em um projeto de codificação. Eu tinha um agente principal coordenando o trabalho, mas cinco subagentes realizando tarefas diferentes ao mesmo tempo. Um subagente examinou a base de código e identificou os arquivos importantes. Outro analisou a implementação existente e destacou problemas potenciais. A terceira analisou a documentação e as dependências associadas ao recurso. O quarto verificou o código em busca de erros e casos extremos. O quinto analisou as alterações propostas e buscou melhorias.

Enquanto esses agentes executavam suas tarefas individuais, o agente mestre concentrava-se no planejamento da implementação e na combinação das descobertas na solução final. Quando recebi uma resposta, a base de código já havia sido explorada, a documentação revisada e a implementação testada de vários ângulos, sem uma única janela de contexto tentando conciliar todas essas informações de uma vez.

Configuração do Claude Subagente

Tudo que você precisa é de uma estrutura e regras simples

Para usar subagentes, você deve primeiro ativar o suporte ao comando do agente. Defina CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 por meio de variáveis ​​de ambiente ou configuração do Código Claude na configuração. Claude Code usa uma ferramenta de tarefa especial para criar subagentes após a ativação. Cada agente criado recebe uma nova janela de contexto e conclui seu trabalho sem compartilhar o histórico completo da conversa.

Descobri que o modelo de orquestrador e trabalhador é adequado para a maioria dos fluxos de trabalho de codificação. Aqui, o gerente verifica a solicitação recebida e divide o trabalho em tarefas menores. O gerente então delega cada tarefa a um subagente específico.

Existe também um modelo Scout que pode ser útil. Inclui um subagente leve que analisa o material de origem e recupera apenas informações relevantes. O agente mestre recebe um breve resumo em vez de processar todo o conjunto de dados. Então você tem o padrão split-merge, onde o orquestrador divide uma tarefa maior em múltiplas tarefas paralelas. Cada subagente conclui o trabalho que lhe foi atribuído sem esperar por outros agentes. A orquestração, após a conclusão, combina os resultados retornados em um resultado final.

Depende muito também de como você escolhe seus modelos. Usei Claude Sonnet para a maioria das tarefas de coordenação e execução. Você também pode usar o Haiku se tiver ações simples que não exijam justificativa. Opus, é claro, funciona melhor como orquestrador mestre.

Certifique-se de que seus prompts de spawn sejam curtos e amáveis. Claude Code já carrega as instruções compartilhadas de CLAUDE.md e as definições de ferramentas disponíveis, e adicionar instruções adicionais aumenta o consumo de contexto antes que o trabalho útil possa começar.

Os subagentes passam pela sua janela de uso

Até mesmo três subagentes podem consumir rapidamente sua janela de uso

Os subagentes economizam muito tempo, mas também aumentam os custos muito mais rápido do que a maioria das pessoas espera. Aprendi isso rapidamente quando comecei a usá-los em projetos maiores. Antes de projetar um fluxo de trabalho multiagente complexo, você deve entender para onde esses tokens realmente vão.

Claude Code cuida de toda a conversa em cada etapa do processo. Isso inclui o prompt do sistema, mensagens anteriores, definições de ferramentas, saídas anteriores e tudo o mais que já está na janela de contexto. O uso de tokens cresce muito mais rápido do que se imagina, à medida que cada nova resposta se baseia em tudo o que veio antes. Uma sessão com apenas trinta mensagens pode facilmente precisar processar cerca de 90.000 tokens.

O custo se torna ainda mais perceptível quando você começa a executar vários subagentes em paralelo. Três agentes, cada um retornando um resumo de 2.000 tokens, adicionam outros 6.000 tokens à sessão pai em um ciclo. Repita esse processo dez vezes e o orquestrador já acumulou cerca de 60.000 tokens apenas com base nos resumos dos subagentes. Este valor não inclui a tarefa original, o histórico de conversas anteriores ou qualquer contexto adicional já carregado na sessão.

Use substitutos com cuidado

Eu gostaria de manter seus subagentes restritos e só tê-los se a tarefa realmente se beneficiar do trabalho paralelo. Cada agente adicional aumenta a quantidade de informações que retornam à orquestra. Esse feedback fornece resultados úteis, mas também aumenta o uso do marcador durante a sessão. Uma equipe menor de agentes especializados geralmente funciona melhor do que um grupo grande que alimenta constantemente os resumos em seu contexto original.

Dei o projeto completo ao Claude Code e ao Google Antigravity e eles terminaram duas vezes mais rápido que o VS Code sozinho

O VS Code precisa ser atualizado.

Link da fonte