PTENES
MÓDULO 4-2

🏗️ Arquitectura de una solución robusta (las 4 capas C)

En el módulo pasado montaste el «hello world» de Jarvis. Ahora viene el plano de la casa: una forma de organizar TODAS las piezas que ya viste en Anatomía en cuatro capas con nombre y orden: Context, Connections, Capabilities y Cadence, el framework CLAWS. Es lo que separa a un agente que dura de una solución improvisada que se rompe con la primera reforma.

6
Temas
~35
Minutos
Intermedio
Nivel
Arquitectura
Tipo
1

🧩 Las 4 C: el esqueleto de cualquier Jarvis

En la Trilha 3 conociste seis piezas sueltas: canales, identidad, herramientas, skills, agentes y cerebros. Conocer las piezas, sin embargo, no es lo mismo que tener una arquitectura. La arquitectura es el plano que indica dónde encaja cada pieza y en qué orden montarla. El framework CLAWS agrupa todo en cuatro capas con la misma inicial: Context, Connections, Capabilities, Cadence — las «4 C».

¿Eres nuevo aquí? "Arquitectura" aquí no tiene nada que ver con edificios: es la forma en que las partes de un sistema se organizan y se comunican. "CLAWS" es solo un apodo (las garras) para recordar las 4 capas C. Y "framework" es un molde mental reutilizable: en vez de inventar la estructura desde cero cada vez, encajas tu proyecto en ese molde.

El orden no es un adorno: es 1 → 2 → 3 → 4 y tiene lógica de dependencias. Sin Context (quién es y qué sabe de ti), no sirve darle Capabilities (actúa sin dirección). Sin Connections (por dónde habla y a qué puede acceder), no hay Cadence (se «despierta» sola, pero no puede actuar ni avisarte). Construye de abajo hacia arriba, como una casa: primero los cimientos y después el techo.

CLAWS · construido de abajo (1) hacia arriba (4) 1 · Contextidentidad + memoria 2 · Connectionscanales + tools 3 · Capabilitiesskills + agentes 4 · Cadenceheartbeat / cron = Jarvis robusto que sabe, accede, hace y actúa por su cuenta

Lee de abajo hacia arriba: cada capa solo tiene sentido cuando la de abajo ya existe. Quita Context y las otras tres se quedan sin dirección; quita Connections e a Cadence no tiene forma de actuar. Juntas, se convierten en un agente que perdura.

🗺️ De pieza suelta a capa con nombre

  • 1.Context = Identidad (3.2) + Cerebros/memoria (3.6). "Quién es y qué sabe de ti."
  • 2.Connections = Canales (3.1) + Herramientas/MCP (3.3). "Por dónde habla y a qué puede acceder."
  • 3.Capabilities = Skills (3.4) + Agentes/subagentes (3.5). "Lo que puede hacer."
  • 4.Cadence = la parte autónoma de los Agentes (3.5): heartbeat/cron. "Cuándo actúa por su cuenta."

Conceptos clave

CLAWS

El apodo de las 4 capas C; una plantilla para no olvidar ninguna.

Las 4 C

Context, Connections, Capabilities, Cadence, en ese orden.

Dependencia

Cada capa necesita la de abajo; por eso importa el orden 1→4.

Arquitectura

El plano que indica dónde encaja cada pieza, no solo la lista de piezas.

2

🪪 Context — quién es y qué sabe de ti

La primera capa —y la más importante— es el Context: la identidad del agente más su memoria. Es lo que marca la diferencia entre un chatbot genérico, que te trata como a un desconocido en cada conversación, y un asistente que sabe tu nombre, tu estilo y dónde se quedaron. Sin Context, todas las demás capas funcionan, pero sin dirección: el agente actúa, pero sin saber para quién ni por qué.

👤 Identidad (quién es)

Proviene de tres archivos de texto, insertados siempre al inicio de la conversación:

  • SOUL.md — el alma: personalidad, tono, valores. "Explica el razonamiento, no solo la respuesta."
  • AGENTS.md — el contrato: lo que SIEMPRE hace y lo que NUNCA hace.
  • USUARIO — quién eres: nombre, contexto, preferencias.

🧠 Memoria (lo que sabe)

La conversación desaparece al cerrarla; la memoria persistente permanece:

  • Archivos .md legibles = la verdad que sobrevive al hype.
  • Índice SQLite FTS5/BM25 para búsqueda rápida por palabra.
  • Los 3 cerebros (3.6): Proyecto, Self y Conocimiento.

¿Eres nuevo aquí? «System prompt» es el bloque de instrucciones que el modelo lee antes de cualquiera de tus mensajes — ahí es donde entra SOUL.md. «SQLite FTS5/BM25» es solo un archivito de base de datos que indexa tus notas para que el agente encuentre «aquello de lo que hablamos la semana pasada» en milisegundos. Y «3 cerebros» es la memoria separada en cajones: Proyecto (lo que pasó), Self (quién es, cambia lentamente) y Conocimiento (hechos que solo se acumulan).

💡 La frase que resume Context

«Sin reconectar el cerebro, la arquitectura es solo una carpeta». — En palabras sencillas: sin darle una personalidad y una memoria de verdad, solo tienes un montón de archivos. Es el Context lo que transforma el código en alguien que te conoce.

Conceptos clave

SOUL.md

El alma: personalidad, valores y tono, siempre en el system prompt.

AGENTS.md

El contrato SIEMPRE/NUNCA — las reglas explícitas valen más que adivinar.

Memoria persistente

.md (verdad) + SQLite (búsqueda); sobrevive porque es solo texto.

3 cerebros

Proyecto, Self y Conocimiento: la memoria organizada en cajones.

3

🔌 Connections — por dónde habla y qué alcanza

La segunda capa son las Connections: los canales (por dónde hablas con él) más las herramientas (lo que puede hacer en el mundo). Sin Connections, el agente tiene alma y memoria, pero queda encerrado en una habitación sin puerta ni manos. Aquí es donde obtiene ojos y dedos: leer tu agenda, enviar un correo, buscar en la web.

📡 Canales: la puerta de entrada y salida

  • •Telegram y es el preferido: solo un token de @BotFather, sin servidor web expuesto.
  • •Lista de permitidos: solo se atiende a TU ID; el resto se ignora en silencio.
  • •WhatsApp, correo electrónico, voz y la propia terminal también son canales.

🔧 Herramientas — las manos (vía MCP)

  • •MCP y es el "USB de las herramientas de IA": cada integración es un servidor independiente.
  • •Conecta Gmail, GitHub, Notion sin reescribir el agente.
  • •Solo MCP, auditable, > descargar Skills de terceros (recuerda las 341 maliciosas).

¿Eres nuevo aquí? «Token» es una contraseña-credencial que Telegram te da para que tu bot pueda conversar (la obtienes en el bot @BotFather). «Long-polling» es la forma de Telegram en la que tu agente pregunta "¿hay un mensaje nuevo?" — así no necesita abrir ningún puerto en tu computadora, lo que es más seguro. "MCP" (Model Context Protocol) es un estándar de Anthropic que hace que cualquier herramienta encaje en cualquier agente, como un conector USB.

🔓 «Sin esto, responde como un extraño»

Un modelo por sí solo solo sabe hablar. Pregunta "¿qué tengo mañana?" y, sin herramientas, adivina. Conecta la agenda vía MCP y la misma pregunta se convierte en una respuesta real. Connections es el paso que transforma un charla en un asistente.

Conceptos clave

Canal

La puerta por la que hablas con él: Telegram, WhatsApp, voz, web.

Long-polling

El bot pregunta si hay mensajes; sin abrir puertos ni exponer el servidor.

MCP

El USB de las herramientas: estándar que conecta cualquier tool al agente.

Lista de permitidos

Solo se atiende a tu ID: el primer bloqueo de seguridad del canal.

4

⚙️ Capabilities — lo que puede hacer

La tercera capa son las Capabilities: las skills (recetas empaquetadas) más los agentes/subagentes (el loop). Si Connections dio la mano, Capabilities enseña movimientos: en vez de explicar cinco pasos cada vez, dices una frase y la skill ejecuta todo el procedimiento.

🧩 Skill = receta; herramienta = ingrediente

Una herramienta realiza una acción atómica (buscar en la web, enviar un correo electrónico). Una skill y un archivo SKILL.md que ORQUESTA varias herramientas con criterio: "escribir una publicación de LinkedIn" se convierte en investigación → gráfico → texto → revisión → publicación.

  • •Carga progresiva: la skill cuesta ~100 tokens (solo el encabezado) hasta que se activa; ahorra contexto.
  • •Cada ejecución mejora la receta; la biblioteca de skills es tu colección de capacidades.

🤝 Subagentes: delegar sin saturar la sesión

El agente principal puede delegar una tarea pesada a una subagente, que consume su PROPIO contexto y devuelve solo la respuesta final. Resultado: la sesión principal queda ligera y cada especialista (investigación, escritura, revisión) se ocupa de su parte. Esto permite realizar tareas grandes sin que el agente "olvide" el inicio a mitad del camino.

⚠️ El error clásico aquí

Acumular capacidades sin tener Context y Connections sólidos. Un agente lleno de skills pero sin memoria ni herramientas reales es potente en el vacío: hace mucho, acierta poco. Por eso Capabilities es la capa 3, no la 1: ella depende de las dos de abajo.

Conceptos clave

Skill

Una receta (SKILL.md) que orquesta herramientas con criterio.

Carga progresiva

La skill cuesta poco hasta que se usa; ahorra contexto.

Subagente

Consume su propio contexto y devuelve solo la respuesta; la sesión queda liviana.

Bucle agéntico

Piensa → llama a la herramienta → lee el resultado → repite hasta concluir.

5

⏰ Cadence — cuándo actúa por su cuenta

La cuarta y última capa es la Cadence: el ritmo propio del agente. Hasta aquí, solo actuaba cuando lo llamabas: era reactivo. Cadence lo convierte proactivo: se "despierta" solo a la hora indicada y hace cosas incluso con la laptop cerrada. Es el salto de un asistente que responde a un compañero que se anticipa.

⏱

Cron / rutinas

Tareas programadas en el reloj: «todos los días a las 7 h, envíame el resumen de la agenda y los correos».

💓

Heartbeat

Un «latido» periódico en el que el agente comprueba si hay algo que hacer y actúa por su cuenta.

🛡

Bloqueo de seguridad

Tope de iteraciones, gates de aprobación y audit log: autonomía con cinturón de seguridad.

¿Eres nuevo aquí? "Cron" es un programador clásico de computadora: activa una tarea en horarios fijos. "Heartbeat" (latido) es una señal que se repite cada cierto tiempo para que el agente "se mueva" por sí solo. Y "audit log" es un diario forense: cada acción que realiza queda registrada, para que después puedas auditar qué pasó y por qué.

⚠️ Cadence sin freno es peligrosa

Dar autonomía horaria a un agente sin límite de iteraciones ni confirmación para acciones peligrosas es como dejar suelto a un robot con las llaves de casa. La regla de oro: cada Cadence viene acompañada de controles de aprobación y de un audit log que registra todo. La autonomía es buena; la autonomía auditable es segura.

Conceptos clave

Cron / rutinas

Tareas programadas en el reloj, a horas fijas.

Heartbeat

Pulso periódico que hace que el agente compruebe y actúe por su cuenta.

Proactivo vs. reactivo

De «responde cuando lo llamo» a «avísame antes de que te lo pida».

Audit log

Diario forense de cada acción; autonomía con trazabilidad.

6

🏛️ Reuniendo las 6 capas en una arquitectura

Ahora, el cierre. Las seis piezas de la Anatomía (Ruta 3) encajan perfectamente dentro de las cuatro capas C —y, al apilarlas en el orden correcto, el mapa suelto se convierte en UNA arquitectura coherente. Cada «C» reúne las piezas que necesita, y el conjunto se eleva como un edificio: cimientos, instalaciones, mobiliario, rutina.

6 piezas de la Anatomía 4 capas C Identidad Cerebros / memoria Canales Herramientas / MCP Skills + Agentes 1 · Context 2 · Connections 3 · Capabilities 4 · Cadence Jarvis coherente una arquitectura, no 6 piezas

Cada pieza morada de la Anatomía entra en una de las cuatro capas amber. Observa que la parte autónoma de los Agentes (línea discontinua cian) alimenta la Cadence. El resultado: no seis piezas sueltas, sino un sistema que sabe, alcanza, hace y actúa, al ritmo adecuado.

🧱 Por qué esta estructura perdura

«Tools change every 6 months. The platform and foundation we're building survive.» — Las herramientas cambian cada seis meses; la plataforma y los cimientos que construyes sobreviven.

Llegan modelos nuevos, aparecen y desaparecen MCP, y algunos canales se ponen de moda y pasan de moda. Pero las 4 C no cambian: todo Jarvis siempre necesitará saber quién es, por dónde hablar, qué hacer y cuándo actuar. Por eso inviertes en la ARQUITECTURA, no en la herramienta del momento.

🎯 Cómo usar las 4 C en la práctica

Antes de construir (o al revisar) cualquier Jarvis, pasa una lista de verificación por las cuatro capas:

  • 1.Context: ¿tiene SOUL/AGENTS/USER y memoria persistente? ¿Sabe quién eres?
  • 2.Connections: ¿tiene un canal seguro (Telegram + whitelist) y herramientas vía MCP?
  • 3.Capabilities: ¿tiene skills útiles y puede delegar en subagentes?
  • 4.Cadence: ¿actúa por su cuenta según el horario, con gates y audit log?

Conceptos clave

Mapeo 6→4

Las 6 piezas de la Anatomía encajan en las 4 capas C.

Una base que perdura

Las herramientas cambian; la arquitectura de las 4 C perdura.

Checklist de CLAWS

Cuatro preguntas para validar (o planificar) cualquier Jarvis.

Coherencia

No seis piezas sueltas, sino un sistema que se sostiene en conjunto.

Autoevaluación (opcional): en el orden de las 4 C, ¿por qué Context va antes que Capabilities?

🎯 Resumen del módulo

✓
Las 4 C (CLAWS) — Context, Connections, Capabilities, Cadence, ensambladas de abajo hacia arriba.
✓
Context — identidad (SOUL/AGENTS/USER) + memoria; quién es y qué sabe de ti.
✓
Connections y Capabilities — canales+herramientas (por dónde habla y llega) y skills+agentes (lo que hace).
✓
Cadence + la síntesis — cuando actúa por su cuenta; las 6 piezas se convierten en UNA arquitectura que perdura aunque cambien las herramientas.

Siguiente módulo:

4-3 — Operar, medir y evolucionar (confianza, costo, seguridad)