Mapa de la ruta
🕹️ Human-in-the-loop × AFK
Sal del bucle
📦 Paralelizar y sandboxes
Agentes aislados
⚙️ GitHub Actions + agentes
AFK en la nube
🧮 Bucles × Colas
Cola, no loop
♻️ Sistemas que se mejoran solos
Compra el candado
🎬 Checkpoints y revisión fluida
Review sin dolor
Contenido detallado
🕹️ Human-in-the-loop × AFK
Sal del bucle: deja de aprobar cada paso y deja que el agente trabaje solo (AFK).
El modo predeterminado: apruebas cada paso y cada acción del agente.
Es seguro, pero se convierte en un cuello de botella — tú eres el límite de velocidad.
Aprobación manual; seguridad × rendimiento.
Dejar que el agente trabaje solo mientras estás lejos del teclado.
Es el salto de productividad: el trabajo se realiza sin ti.
AFK = agente autónomo; sin supervisión.
El momento en que confías lo suficiente en el harness como para salir del bucle.
Desbloquea el paralelismo: varios agentes trabajando al mismo tiempo.
Confianza en el harness → autonomía.
Las tareas riesgosas o ambiguas todavía requieren que estés en el loop.
Dejar AFK a ciegas en la tarea equivocada es como darle las llaves del auto a un junior.
El riesgo × la reversibilidad determinan el modo.
Configurar permisos para que el agente actúe sin pedir aprobación en cada paso.
Cada confirmación manual es una fricción que acaba con el AFK.
Allowlist; aprobación automática con límites.
AFK + paralelismo = varios «tú» trabajando en frentes diferentes.
Es la palanca de escala real del método.
Flota de agentes; tú como gerente.
📦 Paralelizar y sandboxes
Agentes aislados: ejecuta varios en paralelo sin que uno rompa el entorno de otro.
Ejecutar varias tareas con agentes diferentes al mismo tiempo.
Multiplica el throughput sin multiplicar tu tiempo.
Paralelismo = rendimiento; tú te conviertes en orquestador.
Un agente AFK con acceso total a tu máquina puede causar daños.
AFK sin aislamiento es la receta del desastre.
Radio de impacto; aísla antes de liberar.
La herramienta de sandbox que usa Matt para ejecutar agentes aislados.
Es el atajo práctico para usar AFK de forma segura.
Sandbox listo; aislamiento por tarea.
Contenedores como sandbox para cada agente.
Aislamiento estándar de la industria, fácil de descartar y recrear.
Contenedor efímero; entorno reproducible.
Sandboxes administrados en la nube para ejecutar agentes sin usar tu máquina.
Saca al agente de tu laptop y te libera por completo.
Sandbox como servicio; sin bloquear el entorno local.
Coordinar una flota de agentes en sandboxes separadas.
Es donde el paralelismo + el aislamiento se convierten en escala real.
Flota aislada; cada uno en su caja.
⚙️ GitHub Actions + agentes
AFK en la nube: agentes que se ejecutan en CI, abren PRs y nunca bloquean tu máquina.
Ejecutar agentes dentro de GitHub Actions, como un paso del CI.
CI es un sandbox AFK gratuito que ya tienes.
Agente como job; entorno efímero.
Una Action que revisa automáticamente cada PR con un agente.
Revisión coherente en todos los PRs, sin que tengas que acordarte de pedirla.
Review al hacer push; comentarios en el PR.
Aplicar una label a una issue/PR activa al agente para que actúe.
Se convierte en un botón de "envía al agente" dentro de GitHub.
Activación por etiqueta; bajo demanda.
El agente entrega el trabajo como un PR listo para que lo revises.
PR es el punto de control natural entre el modo AFK y la revisión humana.
Salida revisable; nada va directamente a main.
Todo el trabajo se ejecuta en los runners de GitHub, no en tu laptop.
Tienes tiempo libre mientras el agente trabaja en la nube.
Cómputo remoto; laptop liberada.
Crear tu propia Action de agente desde cero (detallada en la Trilha 5).
Una Action tuya se adapta exactamente a tu flujo.
YAML mínimo; checkout → agente → PR.
🧮 Bucles × Colas
Cola, no loop: por qué una cola de tareas supera el loop infinito del agente.
El «Ralph loop» de Geoff Huntley: ejecutar el agente en loop hasta que lo resuelva.
Es el punto de partida — y donde mucha gente se atasca.
Loop bruto; repite hasta que esté "listo".
El loop ciego repite sin priorizar ni delimitar el alcance: desperdicia tokens.
Repetir no es lo mismo que organizar el trabajo.
Loop sin clasificación = costoso e irregular.
En vez de un bucle, una fila de tareas delimitadas que el agente consume.
La cola da orden, prioridad y una parada limpia.
Cola de tareas; consumirlas en orden.
Dividir y priorizar tareas con un alcance claro antes de ponerlas en cola.
Una tarea bien delimitada es una que el agente termina por su cuenta.
Clasificación; alcance claro por elemento.
Eres el rey que da las órdenes; los agentes son los súbditos que las ejecutan.
Fija la mentalidad: tú diriges, no ejecutas.
El rey distribuye; los súbditos ejecutan la cola.
Varios agentes (nodos) extrayendo elementos de la misma cola en paralelo.
Combina cola + paralelismo para obtener el máximo rendimiento.
Workers extrayendo elementos de la cola; escalado horizontal.
♻️ Sistemas que se mejoran solos
Compra el candado: sistemas que detectan problemas y se reparan solos.
Un sistema bien hecho no necesita el modelo más caro para sostenerse.
"Compra el candado": invierte en el sistema, no en la pieza cara.
Sistema económico y robusto > modelo premium.
Un cron que ejecuta periódicamente un agente de revisión de seguridad.
La seguridad se convierte en una rutina automática, no en un esfuerzo puntual.
Cron diario; análisis recurrente.
La telemetría detecta el problema, abre un issue y activa la corrección.
Cierra el ciclo de la observación a la reparación sin que tengas que intervenir.
Detectar → abrir issue → corregir.
El agente busca la causa raíz, no solo el síntoma del bug.
La causa raíz evita que vuelva el mismo problema.
Root cause > band-aid.
El sistema aprende de cada fallo y se ajusta a sí mismo.
La autom mejora sola con el tiempo: el sistema va mejorando por su cuenta.
Ciclo de retroalimentación; mejora compuesta.
Revisar periódicamente el propio sistema de mejora automática.
La autom mejora sin supervisión puede desviarse hacia el lugar equivocado.
Auditar el autoajuste; humano en el nivel superior.
🎬 Checkpoints y revisión fluida
Review sin dolor: mueve el checkpoint a la derecha y revisa al agente sin fricción.
El review es el punto donde verificas y corriges el rumbo del agente.
Es tu red de seguridad en el mundo AFK.
Checkpoint = control de calidad.
Posponer el punto de revisión hasta el final, dando más autonomía al agente.
Cuanto más a la derecha está el checkpoint, más AFK puedes estar.
Mover el checkpoint a medida que aumenta la confianza.
Identificar los puntos de control en los que el humano ya no aporta valor.
Quitar al humano adecuado acelera; quitar al equivocado lo rompe.
Eliminar el checkpoint redundante y mantener el crítico.
Usar un agente para revisar el trabajo de otro antes de que tú lo hagas.
Filtra la mayoría de los errores antes del checkpoint humano.
Agente revisor; doble verificación.
El agente graba un walkthrough en video con narración TTS de lo que hizo.
Revisas mirando el video, en vez de leer diff por diff.
Walkthrough narrado; revisión por video.
Usar la IA para resumir, destacar y acelerar tu revisión humana.
Un review rápido mantiene el AFK en marcha sin convertirse en un cuello de botella.
La IA resume el diff; revisar sin dolor.