Ogni sessione riceve il proprio computer cloud e il proprio branch. L'agente riproduce il bug, scrive la correzione, esegue i test e apre una change request. Tu revisioni un diff.
packages/queue/src/retry.tsconst delay = base * 2 ** attempt;// Full jitter. Without it every worker wakes on the same tick and the// retry storm is indistinguishable from the outage that caused it.const delay = Math.random() * base * 2 ** attempt; packages/queue/src/retry.test.tstest("spreads retries across the window", () => { const spread = sample(1_000).stddev / EXPECTED_MEAN; expect(spread).toBeGreaterThan(0.4);});Non le riscritture. Il piccolo lavoro ben definito che c'è sotto: riproduzioni, aggiornamenti delle dipendenze, test instabili, una rinomina su duecento file.
Prende il report, costruisce il caso sulla propria macchina e torna con un test fallito o con il motivo per cui non ha potuto riprodurlo. Una sessione che non riesce a riprodurre il problema lo dichiara; non inventa una correzione per un bug che non ha mai visto.
Esegue la suite in ciclo, identifica quale test fallisce davvero e con quale frequenza, quindi trova lo stato condiviso o l'ipotesi temporale sottostante. La change request riporta il tasso di errore misurato prima e dopo.
Aggiorna, compila, esegue la suite, legge nel changelog le note sulle modifiche incompatibili e corregge i punti di chiamata spostati. Se la suite diventa rossa, apre comunque la change request, indicando gli errori nella descrizione invece di dichiarare un esito positivo.
Una rinomina, uno spostamento di API, una regola lint attivata: modifiche banali per file, insostenibili su larga scala. Lavora file per file sul proprio branch e consegna un unico diff revisionabile.
Legge gli errori della giornata, li raggruppa per causa principale anziché per messaggio, li ordina in base a quante persone hanno colpito e porta il primo fino alla correzione.
Confronta il comportamento documentato con quello reale e corregge il documento per allinearlo al codice, oppure segnala che è il codice a essere errato. Qui entrambi sono lo stesso tipo di commit: tutto è un file.
Ricevi un diff su un branch, con i test già eseguiti sulla macchina che l'ha prodotto. Non c'è nulla di nuovo da imparare a leggere.
packages/queue/src/retry.ts-const delay = base * 2 ** attempt;+// Full jitter. Without it every worker wakes on the same tick and the+// retry storm is indistinguishable from the outage that caused it.+const delay = Math.random() * base * 2 ** attempt;packages/queue/src/retry.test.ts+test("spreads retries across the window", () => {+ const spread = sample(1_000).stddev / EXPECTED_MEAN;+ expect(spread).toBeGreaterThan(0.4);+});
L'agente salva il commit sul branch della sessione e apre una change request verso main. In revisione arriva un diff con una descrizione: lo stesso oggetto che avrebbe aperto un collega.
La sandbox è una vera macchina Linux: l'agente installa, compila ed esegue la suite autonomamente. Una change request che arriva rossa lo dichiara nella descrizione invece di sostenere che sia verde.
Le sessioni non condividono il working tree. Venti sessioni possono lavorare contemporaneamente sullo stesso repository, ognuna sul proprio branch e computer, senza interferire.
La maggior parte del lavoro avviene nel repository clonato dalla sessione. I connettori coprono il resto e le relative credenziali rimangono dalla nostra parte, mai nella macchina.
Easy connect copre oltre 3.000 app tramite le rispettive schermate OAuth. Tutto ciò che non è nel catalogo è raggiungibile tramite MCP, OpenAPI, GraphQL o HTTP diretto: di solito è la risposta corretta per un servizio interno, che non ha mai avuto una voce in un catalogo pubblico.
Tre modi per avviare la stessa sessione. Isolamento e percorso di revisione non cambiano con il trigger.
Descrivi il bug in un thread Slack oppure avvia una sessione dall'app web o dalla CLI. Ricevi una reazione sul tuo messaggio, non un post del bot, e la risposta arriva nello stesso thread.
Imposta un'azione su Ask: l'esecuzione si ferma sulla chiamata e attende, mostrandoti azione e argomenti. Approva e la stessa chiamata viene completata; la sessione riprende esattamente da dove si era fermata.
Gestisci le eccezioni notturne alle 06:00. Oppure collega il sistema di alert a un webhook firmato, così un evento di paging avvia una sessione con il payload dell'incidente già nel prompt.
La domanda non è cosa può scrivere un agente, ma cosa può consegnare. Ecco la risposta esatta.
Un progetto, un insieme di connettori, una memoria che si arricchisce. Ogni team scrive le competenze per il proprio lavoro; nessuno crea un secondo sistema.