Trabajo con varios clientes y proyectos propios al mismo tiempo. Cada uno con su repositorio, su equipo, sus pull requests esperando revisión. Y la revisión de código, cuando eres el que aprueba, es tu cuello de botella: si no la haces, el dev queda parado. Literalmente esperando que tú mires su trabajo para poder seguir.

Durante mucho tiempo eso fue un dolor diario. Me sentaba, abría un repo, revisaba lo que había, saltaba al siguiente, y para cuando terminaba ya se habían acumulado nuevos en el primero. Una o dos horas cada vez, varias veces al día, y aun así se me acumulaban. PRs pudriéndose días, gente esperando, y yo revisando apurado — que es la peor forma de revisar, porque ahí es cuando se te pasan los detalles.

Así que armé un agente que hace la primera pasada por mí.

La jugada

Corre dos veces al día. Va a todos los repos activos, mira los PRs abiertos, los ordena por prioridad y por fecha — los más viejos primero, porque son los que tienen a alguien esperando hace más rato — y me entrega un resumen PR por PR con una primera revisión hecha.

Yo llego, leo el resumen, hago mi propia revisión en paralelo y comparo. Le doy mis comentarios, y el modelo se encarga de postearlos al repositorio. Pero ojo con esto, que es la parte que no se salta: el modelo solo postea lo que yo apruebo. Nunca postea solo. Yo reviso aparte, comparo con lo que él encontró, y recién ahí sale. Es lo mismo que conté ayer — un humano en el medio, siempre.

Lo interesante es que a veces el agente captura detalles que a mí, revisando entre cansado y apurado, se me habrían pasado. No reemplaza mi ojo, pero es un buen segundo par.

Los números

  • Antes: 1–2 horas por vuelta, varias veces al día. Y con PRs acumulándose igual.

  • Ahora: 1–2 horas, una sola vez al día. Nada se pudre, nadie queda esperando de más.

  • Escala: unos 5 repos, 2–3 PRs por repo en promedio.

No es que el trabajo desapareció — la revisión de verdad sigue siendo mía, y eso es a propósito. Lo que desapareció fue el perseguir: andar saltando de repo en repo para ver qué había, ordenar mentalmente qué era urgente, arrancar de cero cada vez. Eso lo hace el agente. Yo llego a lo que importa, ordenado y masticado.

Y hay algo que no esperaba: se siente como llegar a inbox cero. Terminar todos los PRs del día, dejar la bandeja limpia, saber que nadie del equipo quedó trabado esperándome — eso se siente bien. Y no es solo una sensación: que el equipo avance es lo más importante de todo. Mi cuello de botella dejó de frenar a otros. Esa es la verdadera ganancia, más que las horas.

La parte que costó (y no fue la que crees)

Conectarlo fue lo fácil. Lo difícil fue que ordenara las cosas como yo las quería y que los resúmenes fueran de verdad útiles para mí, no un muro de texto. Eso fue puro ajuste de prompt: probar, ver qué me entregaba, corregir, volver a probar. Hasta que el resumen se leía como yo necesitaba leerlo.

Y todavía lo afino. A veces el agente comenta de más, o mete un comentario que no viene al caso del PR. Ahí es donde entra lo que vengo diciendo toda la semana: el contexto y el "harness" — las reglas y buenas prácticas que le das alrededor — importan tanto como el modelo. Un agente sin buen contexto te da ruido con cara de utilidad.

Me tomó un par de horas armarlo. Un par de horas que ya recuperé muchas veces.

Cómo lo replicas

No necesitas mi caso exacto. Necesitas el patrón:

  1. Busca tu cuello de botella que se repite. El mío era revisar PRs regados en varios repos. El tuyo puede ser revisar cotizaciones, correos, reportes — cualquier cosa donde tú eres el que tapa el flujo y se te acumula.

  2. Que el agente haga la primera pasada, no la final. Que ordene, resuma, proponga. La decisión y la firma quedan contigo.

  3. Invierte en el prompt, no en la herramienta. Lo que hizo la diferencia no fue conectar la API, fue afinar hasta que el resultado se leyera como yo lo necesitaba.

En mi caso el stack es simple: Claude Code + gh CLI para hablar con los repos. Pero la herramienta es lo de menos. El valor está en el patrón: primera pasada automática, decisión humana, y un prompt afinado a lo que tú de verdad necesitas ver.

El lunes: cómo califico oportunidades de clientes sin perder la mañana entera.

Lo más reciente

Esta semana Meta confirmó Meta Compute (1 jul): va a alquilar a terceros la capacidad ociosa de sus data centers. El detalle de fondo: el dueño de más GPUs del mundo admite que le sobra compute y lo quiere vender. Traducción para nosotros: correr agentes como el de arriba va a costar cada vez menos — y una razón más para no casarse con un solo proveedor mientras se acomodan los precios.

Keep Reading