Cada sessão recebe seu próprio computador na nuvem e sua própria branch. O agente reproduz o bug, escreve a correção, executa os testes e abre uma solicitação de alteração. Você revisa um diff.
packages/queue/src/retry.tsconst delay = base * 2 ** attempt;// Full jitter. Without it every worker wakes on the same tick and the// retry storm is indistinguishable from the outage that caused it.const delay = Math.random() * base * 2 ** attempt; packages/queue/src/retry.test.tstest("spreads retries across the window", () => { const spread = sample(1_000).stddev / EXPECTED_MEAN; expect(spread).toBeGreaterThan(0.4);});Não as reescritas. O trabalho pequeno e bem definido por trás delas: reproduções, atualizações de dependências, testes instáveis e uma renomeação em duzentos arquivos.
Ele recebe o relatório, investiga em sua própria máquina e retorna com um teste que falha ou com o motivo pelo qual não conseguiu reproduzir. Uma sessão que não reproduz informa isso. Não inventa uma correção para um bug que nunca viu.
Executa a suíte em loop, isola qual teste falha e com que frequência e encontra o estado compartilhado ou a suposição de timing por trás disso. A solicitação de alteração leva a taxa de falha medida antes e depois.
Atualize, faça o build, execute a suíte, leia as notas de breaking changes no changelog e corrija os pontos de chamada alterados. Se a suíte ficar vermelha, ele abre a solicitação mesmo assim, com as falhas na descrição em vez de alegar sucesso.
Uma renomeação, uma mudança de API, uma regra de lint ativada — trivial por arquivo e insuportável em escala. O agente trabalha arquivo a arquivo em sua branch e entrega um diff revisável.
Ele lê os erros do dia, agrupa por causa raiz em vez de mensagem, classifica pela quantidade de pessoas afetadas e leva o principal até uma correção.
Ele compara o comportamento documentado com o real e corrige o documento para corresponder ao código, ou sinaliza o código como incorreto. Aqui ambos são o mesmo tipo de commit — tudo é um arquivo.
O retorno é um diff em uma branch, com os testes já executados na máquina que o criou. Não há nada novo para aprender a ler.
packages/queue/src/retry.ts-const delay = base * 2 ** attempt;+// Full jitter. Without it every worker wakes on the same tick and the+// retry storm is indistinguishable from the outage that caused it.+const delay = Math.random() * base * 2 ** attempt;packages/queue/src/retry.test.ts+test("spreads retries across the window", () => {+ const spread = sample(1_000).stddev / EXPECTED_MEAN;+ expect(spread).toBeGreaterThan(0.4);+});
O agente faz commit na branch da sessão e abre uma solicitação de alteração contra main. O que chega para revisão é um diff com descrição — o mesmo objeto que um colega teria aberto.
O sandbox é uma máquina Linux real, então o agente instala, compila e executa a suíte sozinho. Uma solicitação de alteração que chega vermelha informa isso na descrição, em vez de alegar sucesso.
As sessões não compartilham working tree. Vinte podem trabalhar no mesmo repositório ao mesmo tempo, cada uma em sua branch e computador, sem interferir umas nas outras.
A maior parte do trabalho ocorre no repositório clonado pela sessão. Os conectores cobrem o restante, e suas credenciais ficam do nosso lado, nunca dentro da máquina.
O Easy connect cobre mais de 3.000 aplicativos por meio de suas telas OAuth. Qualquer coisa fora do catálogo pode ser acessada por MCP, OpenAPI, GraphQL ou HTTP bruto — geralmente a resposta mais honesta para um serviço interno, que nunca teve entrada em catálogo público.
Três formas de iniciar a mesma sessão. O isolamento e o fluxo de revisão não mudam com o gatilho.
Descreva o bug em uma thread do Slack ou inicie uma sessão pelo aplicativo web ou pela CLI. Você recebe uma reação na sua própria mensagem, não uma publicação do bot, e a resposta chega na mesma thread.
Defina uma ação como Ask e a execução pausará na chamada, mostrando a ação e seus argumentos. Aprove, e a mesma chamada será concluída; a sessão continuará exatamente de onde parou.
Faça a triagem das exceções noturnas às 06:00. Ou conecte seu sistema de alertas a um webhook assinado para que um evento de paging inicie uma sessão com o payload do incidente já no prompt.
A questão não é o que um agente pode escrever, mas o que pode entregar. Eis a resposta exata.
Um projeto, um conjunto de conectores, uma memória que se acumula. Cada equipe escreve as skills do próprio trabalho; ninguém monta um segundo sistema.
Comece com uma tarefa e cresça a partir daí.