Cada sesión obtiene su propio ordenador en la nube y su propia rama. El agente reproduce el error, escribe la solución, ejecuta las pruebas y abre una solicitud de cambios. Tú revisas un diff.
packages/queue/src/retry.tsconst delay = base * 2 ** attempt;// Full jitter. Without it every worker wakes on the same tick and the// retry storm is indistinguishable from the outage that caused it.const delay = Math.random() * base * 2 ** attempt; packages/queue/src/retry.test.tstest("spreads retries across the window", () => { const spread = sample(1_000).stddev / EXPECTED_MEAN; expect(spread).toBeGreaterThan(0.4);});No las reescrituras. El trabajo pequeño y bien definido que hay debajo: reproducciones, actualizaciones de dependencias, pruebas inestables y un cambio de nombre en doscientas aplicaciones.
Toma el informe, construye el caso en su propia máquina y vuelve con una prueba fallida o con el motivo por el que no pudo reproducirlo. Una sesión que no puede reproducirlo lo dice. No inventa una solución para un error que nunca vio.
Ejecuta la suite en bucle, aísla qué prueba falla realmente y con qué frecuencia, y encuentra el estado compartido o la suposición temporal subyacente. La solicitud de cambios incluye la tasa de fallos medida antes y después.
Actualiza, compila, ejecuta la suite, lee el changelog para detectar cambios incompatibles y corrige los puntos de llamada que se hayan movido. Si la suite falla, abre igualmente la solicitud de cambios, con los fallos en la descripción en lugar de afirmar que todo está correcto.
Un cambio de nombre, un cambio de API o activar una regla de lint: cambios triviales por archivo e insoportables a escala. Trabaja archivo por archivo en su propia rama y entrega un único diff revisable.
Lee los errores del día, los agrupa por causa raíz en lugar de por mensaje, los clasifica según cuántas personas se vieron afectadas y lleva el primero hasta una solución.
Compara el comportamiento documentado con el real y corrige el documento para que coincida con el código, o marca el código como lo incorrecto. Aquí ambos son el mismo tipo de commit: todo es un archivo.
Lo que vuelve es un diff en una rama, con las pruebas ya ejecutadas en la máquina que lo escribió. No hay nada nuevo que aprender a leer.
packages/queue/src/retry.ts-const delay = base * 2 ** attempt;+// Full jitter. Without it every worker wakes on the same tick and the+// retry storm is indistinguishable from the outage that caused it.+const delay = Math.random() * base * 2 ** attempt;packages/queue/src/retry.test.ts+test("spreads retries across the window", () => {+ const spread = sample(1_000).stddev / EXPECTED_MEAN;+ expect(spread).toBeGreaterThan(0.4);+});
El agente confirma cambios en la rama de sesión y abre una solicitud contra main. Lo que llega a revisión es un diff con una descripción: el mismo objeto que habría abierto un compañero.
El sandbox es una máquina Linux real, así que el agente instala, compila y ejecuta la suite por sí mismo. Una solicitud de cambios que llega con fallos lo indica en la descripción en lugar de afirmar que todo está correcto.
Las sesiones no comparten árbol de trabajo. Veinte pueden ejecutarse simultáneamente sobre el mismo repositorio, cada una en su propia rama y ordenador, sin interferir entre sí.
La mayor parte del trabajo ocurre dentro del repositorio que clonó la sesión. Los conectores cubren el resto y sus credenciales permanecen de nuestro lado, nunca dentro de la máquina.
Easy connect cubre más de 3.000 aplicaciones mediante sus pantallas OAuth. Todo lo que no esté en ese catálogo es accesible mediante MCP, OpenAPI, GraphQL o HTTP directo; suele ser la respuesta honesta para un servicio interno, porque nunca tuvo una entrada pública en el catálogo.
Tres formas de iniciar la misma sesión. El aislamiento y la ruta de revisión no cambian con el disparador.
Describe el error en un hilo de Slack o inicia una sesión desde la aplicación web o la CLI. Recibes una reacción en tu propio mensaje, no una publicación del bot, y la respuesta llega al mismo hilo.
Configura una acción como Ask y la ejecución se detendrá en la llamada y esperará, mostrándote la acción y sus argumentos. Aprueba y la misma llamada se completa; la sesión continúa exactamente desde donde se detuvo.
Clasifica las excepciones nocturnas a las 06:00. O conecta tus alertas a un webhook firmado para que un evento de paginación inicie una sesión con el incidente ya incluido en el prompt.
La pregunta no es qué puede escribir un agente, sino qué puede entregar. Esta es la respuesta exacta.
Un proyecto, un conjunto de conectores y una memoria que se acumula. Cada equipo escribe las habilidades para su propio trabajo; nadie crea un segundo sistema.
Empieza con una tarea y crece desde ahí.