🤝 Agentes: el loop que trabaja solo
Hasta aquí le diste a Jarvis canales, identidad, herramientas y skills. Pero ¿qué lo convierte en un agente — y no solo un chat inteligente: es el bucle autónomo: la capacidad de pensar, actuar, leer el resultado y continuar por tu cuenta hasta terminar. En este módulo entenderás este loop, cómo delegar trabajo a subagentes, cuándo conviene tener varios agentes, cómo se activa a la hora adecuada y dónde poner los controles para que todo esto sea seguro.
🔁 Agente = loop + autonomía
Un chatbot común hace una sola cosa: preguntas, responde y listo. Un agente y es diferente: no se detiene en la primera respuesta. Recibe una solicitud, piensa sobre qué hacer, usa una herramienta (busca en la web, lee un archivo, envía un correo electrónico), lee el resultado de esta herramienta, y decide si ya terminó o si necesita dar un paso más. Ese ir y venir que se repite por sí solo hasta que la tarea está lista es lo que llamamos bucle agéntico.
¿Eres nuevo aquí? Uno agente y un modelo de IA (el «cerebro» de texto que viste en la Trilha 1) que obtuvo manos — las herramientas y el permiso para usarlas en un ciclo. «Loop» es solo la palabra para «repetir un ciclo». «Autonomía» aquí no significa que haga lo que quiera; significa que encadena varios pasos sin que tengas que escribir en cada uno.
En la Trilha 1 viste este loop por primera vez como una idea. Aquí se convierte en una capa de la anatomía: la pieza que transforma «modelo + herramientas» en un asistente que ejecuta. Sin el loop, tendrías que orquestar cada llamada a mano («ahora busca», «ahora resume», «ahora envía»). Con el loop, indicas el objetivo y él mismo descubre la secuencia de pasos.
Lee el diagrama de izquierda a derecha: el el agente piensa, llama a una herramienta, lee lo que volvió y decide. Mientras le falte algo, la flecha discontinua lo lleva de vuelta a "piensa". Cuando termina, sale por la derecha en "listo". Este ciclo que se cierra solo es el corazón de cualquier agente.
Conceptos clave
Un LLM que puede usar herramientas en un ciclo para cumplir un objetivo.
Piensa → actúa → lee el resultado → decide; repite hasta terminar.
Encadenar varios pasos por su cuenta, sin que tengas que escribir cada uno.
Dices el objetivo; él descubre la secuencia.
🧑🚀 Subagentes: delegar y volver con menos carga
Toda conversación de Jarvis vive dentro de una ventana de contexto — su memoria de trabajo, limitada, como la RAM de una computadora (lo viste en la Ruta 1). Si una tarea es grande — leer 30 páginas, recorrer un repositorio entero, investigar 15 fuentes — ella atasca esta ventana con texto sin procesar, y el agente principal se vuelve lento, confuso y caro. La solución elegante es el subagente.
¿Eres nuevo aquí? Uno subagente y un segundo agente que crea el agente principal solo para una tarea pesada. Abre la propia ventana de contexto, hace el trabajo sucio (lo lee todo, lo procesa, descarta lo que sobra) y devuelve solo la respuesta limpia. El desorden queda en su cabeza; el agente principal solo recibe el resumen.
📦 La analogía del pasante
Imagina que eres un gerente ocupado. Llega una tarea: «lee este informe de 200 páginas y dime los 3 puntos principales». No lees las 200 páginas ni llenas tu propia cabeza: mandas a un pasante a leer. Él dedica el tiempo de él con las 200 páginas y vuelve con una nota de 3 líneas. Tu escritorio sigue limpio. El subagente es exactamente ese pasante.
- •El subagente consume el contexto propio con el material en bruto.
- •Solo devuelve la respuesta destilada — no todo el material.
- •La sesión principal queda ligera, enfocada y económica.
✓ Cuándo usar un subagente
- ✓Tarea que genera MUCHO texto intermedio (búsqueda amplia, lectura larga).
- ✓Trabajo aislable: tiene una solicitud clara y devuelve un resultado claro.
- ✓Quieres proteger la conversación principal para que no se vuelva un caos.
✗ Cuándo NO conviene
- ✗Tarea muy breve: abrir un subagente cuesta más que resolverla directamente.
- ✗Pasos que dependen de muchas idas y vueltas contigo en el proceso.
- ✗Cuando NECESITAS ver el material en bruto, no solo el resumen.
Conceptos clave
Agente auxiliar que hace el trabajo pesado y devuelve solo la respuesta.
La memoria de trabajo limitada del agente (la «RAM»).
El desorden queda en el subagente; el principal no se contamina.
Solo vuelve lo esencial: ahorro de contexto y de costos.
🐝 Multiagente: un equipo de especialistas
Si un subagente es un pasante, el multiagente y todo un equipo. En lugar de tener un agente que haga todo, montas varios especialistas — uno que solo investiga, uno que solo escribe, uno que solo revisa — y un orquestador que distribuye las partes y reúne el resultado. Cada especialista tiene su propio contexto, su propio enfoque e incluso puede usar un cerebro diferente (un modelo barato para la búsqueda, uno potente para la redacción).
O orquestador reparte la tarea entre especialistas y después lo integra todo. Más paralelismo y más enfoque, pero también más piezas que coordinar y más posibilidades de que alguna falle. Por eso, el enfoque multiagente solo vale la pena cuando la tarea es lo bastante grande como para justificar la complejidad.
⚠️ La trampa de "más agentes = mejor"
Es tentador montar un ejército de agentes para todo. Casi siempre es exagerado. Cada agente extra agrega coordinación, costo, latencia y nuevos puntos de falla: si la «revisión» interpreta mal lo que entregó la «escritura», el error se propaga. Regla práctica: empieza con un solo agente y el loop. Solo divídelo en varios agentes cuando una tarea real sea demasiado grande o requiera especializaciones que de verdad no puedan convivir en la misma cabeza.
Conceptos clave
Varios agentes especialistas trabajando juntos en una tarea.
El agente que divide el trabajo y reúne los resultados.
Cada agente se enfoca en una cosa (investigación, escritura, revisión).
Más agentes = más piezas que coordinar y más fallas posibles.
⏰ Cadencia: se despierta por su cuenta
Hasta ahora, el agente solo actúa cuando le hablas. La cadencia cambia esto: hace que Jarvis actúe en el horario adecuado, sin que nadie lo llame. A las 7 h, prepara el resumen de tu día; cada 30 minutos, revisa tu bandeja de entrada; todos los viernes, organiza tus notas. Todo esto mientras duermes, trabajas o —como dicen los creadores de estos sistemas— «con la laptop cerrada».
¿Eres nuevo aquí? Cron y es un programador de tareas que existe desde hace décadas en las computadoras: escribes «ejecuta esto todos los días a las 7 h» y obedece. Heartbeat ("latido del corazón") es el mismo principio aplicado al agente: un pulso regular que lo despierta cada cierto tiempo para comprobar si hay algo que hacer. Routines y es solo el nombre amigable que algunos sistemas dan a estas tareas programadas.
Se activa el reloj
Llega la hora programada (p. ej., 7h). El programador activa al agente, sin que tengas que escribir nada.
Ejecuta el loop
El agente ejecuta la tarea programada: lee la agenda, busca los correos y prepara el resumen.
Te avisa por el canal
La respuesta llega a Telegram (o al canal que uses). Te despiertas con el trabajo ya hecho.
📊 Dónde aparece esto en los sistemas reales
- •O OpenClaw popularizó el heartbeat — un pulso que mantiene al agente «vivo» y revisando cosas.
- •O GravityClaw usa node-cron para tareas programadas, manteniendo todo conciso.
- •En la arquitectura de las "4 C" (Trilha 4), esto es la Cadence — el «cuándo actúa».
Conceptos clave
La capa que hace que el agente actúe a la hora programada, sin que lo llamen.
Programador clásico: «ejecuta esto a esta hora».
Pulso periódico que despierta al agente para revisar tareas.
Tareas programadas con un nombre sencillo (resumen de las 7 h, etc.).
🛡️ Límites y seguridad del loop
Un agente que actúa por su cuenta es poderoso, y por eso mismo necesita frenos. Sin límites, el ciclo puede girar para siempre (y costar una fortuna) o ejecutar una acción peligrosa sin que nadie se dé cuenta. Tres frenos resuelven la mayor parte de esto: un límite de iteraciones, gates de aprobación y un registro de auditoría.
¿Eres nuevo aquí? Límite (o tope) de iteraciones y un número máximo de vueltas que puede dar el loop antes de detenerse (p. ej., «como máximo 15»). Paso de aprobación y una solicitud de «¿confirmas?» antes de una acción arriesgada. Audit log y un diario que registra cada paso que dio el agente: una «memoria forense» para que luego revises qué hizo y por qué.
🔢 Tope de iteraciones
Limita cuántas vueltas puede dar el bucle. Evita que el agente se quede «pensando» eternamente y gaste dinero innecesariamente.
✋ Pasos de aprobación
Las acciones peligrosas (borrar archivos, gastar dinero, ejecutar comandos) se detienen y piden tu «ok» antes de realizarse.
📜 Audit log
Cada paso queda registrado. Si algo sale mal, abres el diario y ves exactamente qué hizo y cuándo.
⚠️ Por qué esto no es opcional
Recuerda la Ruta 2: OpenClaw tuvo 42.665 instancias públicas, siendo 93,4% sin ninguna autenticación, e 341 skills maliciosas en la comunidad. Un agente expuesto y sin restricciones es un agente al que cualquiera puede ordenarle que actúe. La postura correcta es zero-trust: trata cada entrada como un posible ataque (incluidas prompt-injection, cuando un texto malicioso intenta darle órdenes encubiertas al agente).
La combinación segura, repetida en todo el curso: sin puertos expuestos + solo MCP auditable + lista de permitidos de quién puede hablar + secrets en .env + los tres frenos anteriores.
Conceptos clave
Número máximo de iteraciones del bucle: evita el bucle infinito y el gasto excesivo.
Confirmación humana antes de una acción peligrosa.
Registro forense de cada acción del agente.
Texto malicioso que intenta darle órdenes encubiertas al agente.
🚀 Proactivo vs. reactivo: de asistente a aliado
Une todo lo de este módulo —el loop, los subagentes, la cadencia— y llegarás al mayor salto de todos: Jarvis deja de ser reactivo (solo responde cuando lo llamas) y pasa a ser proactivo (te avisa antes de que se lo pidas). En vez de preguntar «¿hay algo importante en mi agenda hoy?», te escribe a las 7h: «tienes una reunión a las 10h y el informe vence mañana; ¿quieres que prepare un borrador?».
😐 Reactivo (el asistente)
- →Espera a que tú inicies la conversación.
- →Solo sabe lo que escribiste ahora.
- →Útil, pero todavía cargas con el esfuerzo mental de recordarlo todo.
🤝 Proactivo (el compañero)
- →Inicia la conversación cuando tiene sentido (cadencia).
- →Conecta calendario, correo electrónico y memoria para anticiparse.
- →Te quita carga mental: se convierte en un socio, no en una herramienta.
🧩 La receta para el salto proactivo
La proactividad no es magia: es la suma de las piezas que ya conoces. Bucle (se ejecuta solo) + cadencia (se despierta a la hora indicada) + herramientas (ve tu agenda y tu correo, de la Ruta 3-3) + memoria (recuerda lo importante, viene en la 3-6). Quita cualquier pieza y vuelve a ser reactivo.
Cuidado con el equilibrio: un agente demasiado proactivo se vuelve molesto e interrumpe todo el tiempo. La buena proactividad es selectiva: avisa de lo importante y se queda quieto el resto del tiempo.
Autoevaluación (opcional): ¿cuál es la mejor descripción de un subagente?
Conceptos clave
Solo actúa cuando lo llamas: el modo «asistente».
Te avisa antes de que lo pidas: el modo «compañero».
El peso de recordarlo todo; el proactivo te quita esa carga.
Avisarte de lo que importa y guardar silencio el resto del tiempo.
🎯 Resumen del módulo
Siguiente módulo:
Módulo 3-6: Cerebros — el motor que piensa y la memoria organizada