VIBE IN PUBLIC_

Vibe coding com várias sessões de IA ao mesmo tempo: uma por frente

Moretté perdeu a conta das sessões que tinha abertas ao vivo. O arranjo por trás do tropeço explica por que a compactação atinge uma frente só.

Toda sessão de agente tem um teto de contexto. Quando ela bate nesse teto, o agente compacta o histórico: guarda algumas coisas chave e deixa o resto ir embora. Você decide o tamanho desse prejuízo bem antes, na hora de escolher o que vai pedir dentro daquela sessão.

Moretté deixou o arranjo dele à mostra numa live de agosto, ao tentar contar quantas sessões tinha em pé:

"Tava com três terminal abertos de serviço. Um para não, quatro, cinco."

Ele começou em 3, corrigiu para 4 e parou em 5. Só depois enumerou as frentes, uma para cada projeto ou tarefa, entre elas uma que estava dedicada a revisar código.

Uma frente por sessão, e cada conversa dentro do assunto dela

Uma sessão fica com um tipo de coisa e recebe só pedidos daquele tipo, a outra fica com outro tipo e recebe os dela. Quando o assunto muda, ele muda de sessão, em vez de emendar a frente nova no histórico de quem já estava ocupado com outra.

O efeito aparece no que cada histórico acumula: a sessão que revisa código guarda contexto de revisão, a de um projeto guarda o daquele projeto, e nenhuma das duas carrega o peso da outra.

Por que a repartição importa quando a compactação chega

A compactação é local. Ela acontece dentro de uma sessão, quando aquela sessão chega no próprio limite, e o que ela poda é o histórico daquela sessão. As outras não sentem nada e seguem com o detalhe inteiro do que estavam fazendo. O estrago fica onde o volume apareceu.

Numa sessão única para tudo, o limite passa a ser compartilhado por assuntos que não têm relação nenhuma entre si. A frente que quase não falou é comprimida no mesmo movimento que a frente que falou o dia inteiro, e some detalhe de uma por causa do volume da outra. O arranjo por frente decide quem paga a conta da compactação.

Reduzir o consumo dentro de uma sessão é um problema diferente, e Moretté tratou dele na mesma live, trocando para o modo de planejamento antes de mandar executar. Se é isso que você procura, está no post sobre modo de planejamento para economizar contexto. Aqui o assunto é como o trabalho fica repartido entre sessões, para que a compactação, quando vier, alcance uma frente só.

O preço que o próprio tropeço entrega

A contagem interrompida é a melhor descrição do custo desse arranjo. Cada sessão aberta é uma que você precisa lembrar que existe e em que estado deixou: o que já pediu, o que ela devolveu, onde parou. Esse acompanhamento não tem tela própria e cresce a cada terminal novo.

Ele não diz qual é o número saudável de sessões, e não dá para tirar um da live. O que dá para tirar é o formato do problema: o ganho da separação fica no contexto, e o custo fica com você, na memória de quem está tocando as sessões. Quem faz vibe coding com várias sessões de IA ao mesmo tempo troca risco de compactação por carga de acompanhamento. Foi o mesmo caminho de vibe coding para nao misturar dois produtos no mesmo servidor. Foi o mesmo caminho de vibe coding para centralizar comentarios de varias aulas numa caixa de entrada.

O vibe coding em paralelo começa antes de abrir a segunda sessão

Decida do que a sessão nova vai ser dona antes do primeiro pedido, e mantenha essa fronteira mesmo quando for mais rápido perguntar na janela que já está aberta. Toda pergunta fora do assunto entra naquele histórico e conta para o limite daquela frente, então a pressa de agora sai do detalhe que você vai querer depois.

Vale anotar fora dos terminais o que cada sessão está fazendo, porque a contagem some rápido. E vale escolher as fronteiras por onde o trabalho já se separa sozinho, projeto por projeto ou tarefa por tarefa, do jeito que ele fez ao deixar uma sessão só para revisar código.

São decisões repetidas e sem graça como essa que sustentam o vibe coding tocado em várias janelas ao mesmo tempo. Dá para ver a cena completa, com a contagem perdida e a explicação do limite, ao assistir à live.