PTENES
MÓDULO 3-5

🤝 Agentes: el loop que trabaja solo

Hasta aquí le diste a Jarvis canales, identidad, herramientas y skills. Pero ¿qué lo convierte en un agente — y no solo un chat inteligente: es el bucle autónomo: la capacidad de pensar, actuar, leer el resultado y continuar por tu cuenta hasta terminar. En este módulo entenderás este loop, cómo delegar trabajo a subagentes, cuándo conviene tener varios agentes, cómo se activa a la hora adecuada y dónde poner los controles para que todo esto sea seguro.

6
Temas
~50
Minutos
Intermedio
Nivel
Anatomía
Tipo
1

🔁 Agente = loop + autonomía

Un chatbot común hace una sola cosa: preguntas, responde y listo. Un agente y es diferente: no se detiene en la primera respuesta. Recibe una solicitud, piensa sobre qué hacer, usa una herramienta (busca en la web, lee un archivo, envía un correo electrónico), lee el resultado de esta herramienta, y decide si ya terminó o si necesita dar un paso más. Ese ir y venir que se repite por sí solo hasta que la tarea está lista es lo que llamamos bucle agéntico.

¿Eres nuevo aquí? Uno agente y un modelo de IA (el «cerebro» de texto que viste en la Trilha 1) que obtuvo manos — las herramientas y el permiso para usarlas en un ciclo. «Loop» es solo la palabra para «repetir un ciclo». «Autonomía» aquí no significa que haga lo que quiera; significa que encadena varios pasos sin que tengas que escribir en cada uno.

En la Trilha 1 viste este loop por primera vez como una idea. Aquí se convierte en una capa de la anatomía: la pieza que transforma «modelo + herramientas» en un asistente que ejecuta. Sin el loop, tendrías que orquestar cada llamada a mano («ahora busca», «ahora resume», «ahora envía»). Con el loop, indicas el objetivo y él mismo descubre la secuencia de pasos.

EL BUCLE AGÉNTICO pedido piensa¿qué falta? herramientabuscar · leer · enviar lee el resultadoy evalúa si todavía no terminó, vuelve a pensar (repite) listoresponde

Lee el diagrama de izquierda a derecha: el el agente piensa, llama a una herramienta, lee lo que volvió y decide. Mientras le falte algo, la flecha discontinua lo lleva de vuelta a "piensa". Cuando termina, sale por la derecha en "listo". Este ciclo que se cierra solo es el corazón de cualquier agente.

Conceptos clave

Agente

Un LLM que puede usar herramientas en un ciclo para cumplir un objetivo.

Bucle agéntico

Piensa → actúa → lee el resultado → decide; repite hasta terminar.

Autonomía

Encadenar varios pasos por su cuenta, sin que tengas que escribir cada uno.

Delegar > preguntar

Dices el objetivo; él descubre la secuencia.

2

🧑‍🚀 Subagentes: delegar y volver con menos carga

Toda conversación de Jarvis vive dentro de una ventana de contexto — su memoria de trabajo, limitada, como la RAM de una computadora (lo viste en la Ruta 1). Si una tarea es grande — leer 30 páginas, recorrer un repositorio entero, investigar 15 fuentes — ella atasca esta ventana con texto sin procesar, y el agente principal se vuelve lento, confuso y caro. La solución elegante es el subagente.

¿Eres nuevo aquí? Uno subagente y un segundo agente que crea el agente principal solo para una tarea pesada. Abre la propia ventana de contexto, hace el trabajo sucio (lo lee todo, lo procesa, descarta lo que sobra) y devuelve solo la respuesta limpia. El desorden queda en su cabeza; el agente principal solo recibe el resumen.

📦 La analogía del pasante

Imagina que eres un gerente ocupado. Llega una tarea: «lee este informe de 200 páginas y dime los 3 puntos principales». No lees las 200 páginas ni llenas tu propia cabeza: mandas a un pasante a leer. Él dedica el tiempo de él con las 200 páginas y vuelve con una nota de 3 líneas. Tu escritorio sigue limpio. El subagente es exactamente ese pasante.

  • •El subagente consume el contexto propio con el material en bruto.
  • •Solo devuelve la respuesta destilada — no todo el material.
  • •La sesión principal queda ligera, enfocada y económica.

✓ Cuándo usar un subagente

  • ✓Tarea que genera MUCHO texto intermedio (búsqueda amplia, lectura larga).
  • ✓Trabajo aislable: tiene una solicitud clara y devuelve un resultado claro.
  • ✓Quieres proteger la conversación principal para que no se vuelva un caos.

✗ Cuándo NO conviene

  • ✗Tarea muy breve: abrir un subagente cuesta más que resolverla directamente.
  • ✗Pasos que dependen de muchas idas y vueltas contigo en el proceso.
  • ✗Cuando NECESITAS ver el material en bruto, no solo el resumen.

Conceptos clave

Subagente

Agente auxiliar que hace el trabajo pesado y devuelve solo la respuesta.

Ventana de contexto

La memoria de trabajo limitada del agente (la «RAM»).

Aislamiento de contexto

El desorden queda en el subagente; el principal no se contamina.

Respuesta destilada

Solo vuelve lo esencial: ahorro de contexto y de costos.

3

🐝 Multiagente: un equipo de especialistas

Si un subagente es un pasante, el multiagente y todo un equipo. En lugar de tener un agente que haga todo, montas varios especialistas — uno que solo investiga, uno que solo escribe, uno que solo revisa — y un orquestador que distribuye las partes y reúne el resultado. Cada especialista tiene su propio contexto, su propio enfoque e incluso puede usar un cerebro diferente (un modelo barato para la búsqueda, uno potente para la redacción).

ESTÁNDAR MULTIAGENTE orquestadordivide y une investigaciónbusca fuentes escritaredacta revisióncomprueba las partes vuelven y el orquestador las reúne en un único resultado

O orquestador reparte la tarea entre especialistas y después lo integra todo. Más paralelismo y más enfoque, pero también más piezas que coordinar y más posibilidades de que alguna falle. Por eso, el enfoque multiagente solo vale la pena cuando la tarea es lo bastante grande como para justificar la complejidad.

⚠️ La trampa de "más agentes = mejor"

Es tentador montar un ejército de agentes para todo. Casi siempre es exagerado. Cada agente extra agrega coordinación, costo, latencia y nuevos puntos de falla: si la «revisión» interpreta mal lo que entregó la «escritura», el error se propaga. Regla práctica: empieza con un solo agente y el loop. Solo divídelo en varios agentes cuando una tarea real sea demasiado grande o requiera especializaciones que de verdad no puedan convivir en la misma cabeza.

Conceptos clave

Multiagente

Varios agentes especialistas trabajando juntos en una tarea.

Orquestador

El agente que divide el trabajo y reúne los resultados.

Especialización

Cada agente se enfoca en una cosa (investigación, escritura, revisión).

Costo de coordinación

Más agentes = más piezas que coordinar y más fallas posibles.

4

⏰ Cadencia: se despierta por su cuenta

Hasta ahora, el agente solo actúa cuando le hablas. La cadencia cambia esto: hace que Jarvis actúe en el horario adecuado, sin que nadie lo llame. A las 7 h, prepara el resumen de tu día; cada 30 minutos, revisa tu bandeja de entrada; todos los viernes, organiza tus notas. Todo esto mientras duermes, trabajas o —como dicen los creadores de estos sistemas— «con la laptop cerrada».

¿Eres nuevo aquí? Cron y es un programador de tareas que existe desde hace décadas en las computadoras: escribes «ejecuta esto todos los días a las 7 h» y obedece. Heartbeat ("latido del corazón") es el mismo principio aplicado al agente: un pulso regular que lo despierta cada cierto tiempo para comprobar si hay algo que hacer. Routines y es solo el nombre amigable que algunos sistemas dan a estas tareas programadas.

1

Se activa el reloj

Llega la hora programada (p. ej., 7h). El programador activa al agente, sin que tengas que escribir nada.

2

Ejecuta el loop

El agente ejecuta la tarea programada: lee la agenda, busca los correos y prepara el resumen.

3

Te avisa por el canal

La respuesta llega a Telegram (o al canal que uses). Te despiertas con el trabajo ya hecho.

📊 Dónde aparece esto en los sistemas reales

  • •O OpenClaw popularizó el heartbeat — un pulso que mantiene al agente «vivo» y revisando cosas.
  • •O GravityClaw usa node-cron para tareas programadas, manteniendo todo conciso.
  • •En la arquitectura de las "4 C" (Trilha 4), esto es la Cadence — el «cuándo actúa».

Conceptos clave

Cadencia

La capa que hace que el agente actúe a la hora programada, sin que lo llamen.

Cron

Programador clásico: «ejecuta esto a esta hora».

Heartbeat

Pulso periódico que despierta al agente para revisar tareas.

Routines

Tareas programadas con un nombre sencillo (resumen de las 7 h, etc.).

5

🛡️ Límites y seguridad del loop

Un agente que actúa por su cuenta es poderoso, y por eso mismo necesita frenos. Sin límites, el ciclo puede girar para siempre (y costar una fortuna) o ejecutar una acción peligrosa sin que nadie se dé cuenta. Tres frenos resuelven la mayor parte de esto: un límite de iteraciones, gates de aprobación y un registro de auditoría.

¿Eres nuevo aquí? Límite (o tope) de iteraciones y un número máximo de vueltas que puede dar el loop antes de detenerse (p. ej., «como máximo 15»). Paso de aprobación y una solicitud de «¿confirmas?» antes de una acción arriesgada. Audit log y un diario que registra cada paso que dio el agente: una «memoria forense» para que luego revises qué hizo y por qué.

🔢 Tope de iteraciones

Limita cuántas vueltas puede dar el bucle. Evita que el agente se quede «pensando» eternamente y gaste dinero innecesariamente.

✋ Pasos de aprobación

Las acciones peligrosas (borrar archivos, gastar dinero, ejecutar comandos) se detienen y piden tu «ok» antes de realizarse.

📜 Audit log

Cada paso queda registrado. Si algo sale mal, abres el diario y ves exactamente qué hizo y cuándo.

⚠️ Por qué esto no es opcional

Recuerda la Ruta 2: OpenClaw tuvo 42.665 instancias públicas, siendo 93,4% sin ninguna autenticación, e 341 skills maliciosas en la comunidad. Un agente expuesto y sin restricciones es un agente al que cualquiera puede ordenarle que actúe. La postura correcta es zero-trust: trata cada entrada como un posible ataque (incluidas prompt-injection, cuando un texto malicioso intenta darle órdenes encubiertas al agente).

La combinación segura, repetida en todo el curso: sin puertos expuestos + solo MCP auditable + lista de permitidos de quién puede hablar + secrets en .env + los tres frenos anteriores.

Conceptos clave

Tope de iteraciones

Número máximo de iteraciones del bucle: evita el bucle infinito y el gasto excesivo.

Paso de aprobación

Confirmación humana antes de una acción peligrosa.

Audit log

Registro forense de cada acción del agente.

Prompt injection

Texto malicioso que intenta darle órdenes encubiertas al agente.

6

🚀 Proactivo vs. reactivo: de asistente a aliado

Une todo lo de este módulo —el loop, los subagentes, la cadencia— y llegarás al mayor salto de todos: Jarvis deja de ser reactivo (solo responde cuando lo llamas) y pasa a ser proactivo (te avisa antes de que se lo pidas). En vez de preguntar «¿hay algo importante en mi agenda hoy?», te escribe a las 7h: «tienes una reunión a las 10h y el informe vence mañana; ¿quieres que prepare un borrador?».

😐 Reactivo (el asistente)

  • →Espera a que tú inicies la conversación.
  • →Solo sabe lo que escribiste ahora.
  • →Útil, pero todavía cargas con el esfuerzo mental de recordarlo todo.

🤝 Proactivo (el compañero)

  • →Inicia la conversación cuando tiene sentido (cadencia).
  • →Conecta calendario, correo electrónico y memoria para anticiparse.
  • →Te quita carga mental: se convierte en un socio, no en una herramienta.

🧩 La receta para el salto proactivo

La proactividad no es magia: es la suma de las piezas que ya conoces. Bucle (se ejecuta solo) + cadencia (se despierta a la hora indicada) + herramientas (ve tu agenda y tu correo, de la Ruta 3-3) + memoria (recuerda lo importante, viene en la 3-6). Quita cualquier pieza y vuelve a ser reactivo.

Cuidado con el equilibrio: un agente demasiado proactivo se vuelve molesto e interrumpe todo el tiempo. La buena proactividad es selectiva: avisa de lo importante y se queda quieto el resto del tiempo.

Autoevaluación (opcional): ¿cuál es la mejor descripción de un subagente?

Conceptos clave

Reactivo

Solo actúa cuando lo llamas: el modo «asistente».

Proactivo

Te avisa antes de que lo pidas: el modo «compañero».

Carga mental

El peso de recordarlo todo; el proactivo te quita esa carga.

Proactividad selectiva

Avisarte de lo que importa y guardar silencio el resto del tiempo.

🎯 Resumen del módulo

✓
Agente = bucle + autonomía — piensa, actúa, lee el resultado y decide; repite por su cuenta hasta terminar.
✓
Subagentes — el «pasante» consume su propio contexto y devuelve solo la respuesta; la sesión principal se mantiene ligera.
✓
Multiagente con moderación — equipo de especialistas + orquestador; solo vale la pena cuando la tarea justifica la complejidad.
✓
Cadencia — cron/heartbeat hacen que Jarvis actúe a la hora prevista, «con la laptop cerrada».
✓
Bloqueos del loop — límite de iteraciones, gates de aprobación y audit log; enfoque de confianza cero.
✓
Proactivo vs. reactivo — loop + cadencia + herramientas + memoria = el salto de asistente a compañero.

Siguiente módulo:

Módulo 3-6: Cerebros — el motor que piensa y la memoria organizada