🏗️ Arquitectura de una solución robusta (las 4 capas C)
En el módulo pasado montaste el «hello world» de Jarvis. Ahora viene el plano de la casa: una forma de organizar TODAS las piezas que ya viste en Anatomía en cuatro capas con nombre y orden: Context, Connections, Capabilities y Cadence, el framework CLAWS. Es lo que separa a un agente que dura de una solución improvisada que se rompe con la primera reforma.
🧩 Las 4 C: el esqueleto de cualquier Jarvis
En la Trilha 3 conociste seis piezas sueltas: canales, identidad, herramientas, skills, agentes y cerebros. Conocer las piezas, sin embargo, no es lo mismo que tener una arquitectura. La arquitectura es el plano que indica dónde encaja cada pieza y en qué orden montarla. El framework CLAWS agrupa todo en cuatro capas con la misma inicial: Context, Connections, Capabilities, Cadence — las «4 C».
¿Eres nuevo aquí? "Arquitectura" aquí no tiene nada que ver con edificios: es la forma en que las partes de un sistema se organizan y se comunican. "CLAWS" es solo un apodo (las garras) para recordar las 4 capas C. Y "framework" es un molde mental reutilizable: en vez de inventar la estructura desde cero cada vez, encajas tu proyecto en ese molde.
El orden no es un adorno: es 1 → 2 → 3 → 4 y tiene lógica de dependencias. Sin Context (quién es y qué sabe de ti), no sirve darle Capabilities (actúa sin dirección). Sin Connections (por dónde habla y a qué puede acceder), no hay Cadence (se «despierta» sola, pero no puede actuar ni avisarte). Construye de abajo hacia arriba, como una casa: primero los cimientos y después el techo.
Lee de abajo hacia arriba: cada capa solo tiene sentido cuando la de abajo ya existe. Quita Context y las otras tres se quedan sin dirección; quita Connections e a Cadence no tiene forma de actuar. Juntas, se convierten en un agente que perdura.
🗺️ De pieza suelta a capa con nombre
- 1.Context = Identidad (3.2) + Cerebros/memoria (3.6). "Quién es y qué sabe de ti."
- 2.Connections = Canales (3.1) + Herramientas/MCP (3.3). "Por dónde habla y a qué puede acceder."
- 3.Capabilities = Skills (3.4) + Agentes/subagentes (3.5). "Lo que puede hacer."
- 4.Cadence = la parte autónoma de los Agentes (3.5): heartbeat/cron. "Cuándo actúa por su cuenta."
Conceptos clave
El apodo de las 4 capas C; una plantilla para no olvidar ninguna.
Context, Connections, Capabilities, Cadence, en ese orden.
Cada capa necesita la de abajo; por eso importa el orden 1→4.
El plano que indica dónde encaja cada pieza, no solo la lista de piezas.
🪪 Context — quién es y qué sabe de ti
La primera capa —y la más importante— es el Context: la identidad del agente más su memoria. Es lo que marca la diferencia entre un chatbot genérico, que te trata como a un desconocido en cada conversación, y un asistente que sabe tu nombre, tu estilo y dónde se quedaron. Sin Context, todas las demás capas funcionan, pero sin dirección: el agente actúa, pero sin saber para quién ni por qué.
👤 Identidad (quién es)
Proviene de tres archivos de texto, insertados siempre al inicio de la conversación:
- SOUL.md — el alma: personalidad, tono, valores. "Explica el razonamiento, no solo la respuesta."
- AGENTS.md — el contrato: lo que SIEMPRE hace y lo que NUNCA hace.
- USUARIO — quién eres: nombre, contexto, preferencias.
🧠 Memoria (lo que sabe)
La conversación desaparece al cerrarla; la memoria persistente permanece:
- Archivos .md legibles = la verdad que sobrevive al hype.
- Índice SQLite FTS5/BM25 para búsqueda rápida por palabra.
- Los 3 cerebros (3.6): Proyecto, Self y Conocimiento.
¿Eres nuevo aquí? «System prompt» es el bloque de instrucciones que el modelo lee antes de cualquiera de tus mensajes — ahí es donde entra SOUL.md. «SQLite FTS5/BM25» es solo un archivito de base de datos que indexa tus notas para que el agente encuentre «aquello de lo que hablamos la semana pasada» en milisegundos. Y «3 cerebros» es la memoria separada en cajones: Proyecto (lo que pasó), Self (quién es, cambia lentamente) y Conocimiento (hechos que solo se acumulan).
💡 La frase que resume Context
«Sin reconectar el cerebro, la arquitectura es solo una carpeta». — En palabras sencillas: sin darle una personalidad y una memoria de verdad, solo tienes un montón de archivos. Es el Context lo que transforma el código en alguien que te conoce.
Conceptos clave
El alma: personalidad, valores y tono, siempre en el system prompt.
El contrato SIEMPRE/NUNCA — las reglas explícitas valen más que adivinar.
.md (verdad) + SQLite (búsqueda); sobrevive porque es solo texto.
Proyecto, Self y Conocimiento: la memoria organizada en cajones.
🔌 Connections — por dónde habla y qué alcanza
La segunda capa son las Connections: los canales (por dónde hablas con él) más las herramientas (lo que puede hacer en el mundo). Sin Connections, el agente tiene alma y memoria, pero queda encerrado en una habitación sin puerta ni manos. Aquí es donde obtiene ojos y dedos: leer tu agenda, enviar un correo, buscar en la web.
📡 Canales: la puerta de entrada y salida
- •Telegram y es el preferido: solo un token de @BotFather, sin servidor web expuesto.
- •Lista de permitidos: solo se atiende a TU ID; el resto se ignora en silencio.
- •WhatsApp, correo electrónico, voz y la propia terminal también son canales.
🔧 Herramientas — las manos (vía MCP)
- •MCP y es el "USB de las herramientas de IA": cada integración es un servidor independiente.
- •Conecta Gmail, GitHub, Notion sin reescribir el agente.
- •Solo MCP, auditable, > descargar Skills de terceros (recuerda las 341 maliciosas).
¿Eres nuevo aquí? «Token» es una contraseña-credencial que Telegram te da para que tu bot pueda conversar (la obtienes en el bot @BotFather). «Long-polling» es la forma de Telegram en la que tu agente pregunta "¿hay un mensaje nuevo?" — así no necesita abrir ningún puerto en tu computadora, lo que es más seguro. "MCP" (Model Context Protocol) es un estándar de Anthropic que hace que cualquier herramienta encaje en cualquier agente, como un conector USB.
🔓 «Sin esto, responde como un extraño»
Un modelo por sí solo solo sabe hablar. Pregunta "¿qué tengo mañana?" y, sin herramientas, adivina. Conecta la agenda vía MCP y la misma pregunta se convierte en una respuesta real. Connections es el paso que transforma un charla en un asistente.
Conceptos clave
La puerta por la que hablas con él: Telegram, WhatsApp, voz, web.
El bot pregunta si hay mensajes; sin abrir puertos ni exponer el servidor.
El USB de las herramientas: estándar que conecta cualquier tool al agente.
Solo se atiende a tu ID: el primer bloqueo de seguridad del canal.
⚙️ Capabilities — lo que puede hacer
La tercera capa son las Capabilities: las skills (recetas empaquetadas) más los agentes/subagentes (el loop). Si Connections dio la mano, Capabilities enseña movimientos: en vez de explicar cinco pasos cada vez, dices una frase y la skill ejecuta todo el procedimiento.
🧩 Skill = receta; herramienta = ingrediente
Una herramienta realiza una acción atómica (buscar en la web, enviar un correo electrónico). Una skill y un archivo SKILL.md que ORQUESTA varias herramientas con criterio: "escribir una publicación de LinkedIn" se convierte en investigación → gráfico → texto → revisión → publicación.
- •Carga progresiva: la skill cuesta ~100 tokens (solo el encabezado) hasta que se activa; ahorra contexto.
- •Cada ejecución mejora la receta; la biblioteca de skills es tu colección de capacidades.
🤝 Subagentes: delegar sin saturar la sesión
El agente principal puede delegar una tarea pesada a una subagente, que consume su PROPIO contexto y devuelve solo la respuesta final. Resultado: la sesión principal queda ligera y cada especialista (investigación, escritura, revisión) se ocupa de su parte. Esto permite realizar tareas grandes sin que el agente "olvide" el inicio a mitad del camino.
⚠️ El error clásico aquí
Acumular capacidades sin tener Context y Connections sólidos. Un agente lleno de skills pero sin memoria ni herramientas reales es potente en el vacío: hace mucho, acierta poco. Por eso Capabilities es la capa 3, no la 1: ella depende de las dos de abajo.
Conceptos clave
Una receta (SKILL.md) que orquesta herramientas con criterio.
La skill cuesta poco hasta que se usa; ahorra contexto.
Consume su propio contexto y devuelve solo la respuesta; la sesión queda liviana.
Piensa → llama a la herramienta → lee el resultado → repite hasta concluir.
⏰ Cadence — cuándo actúa por su cuenta
La cuarta y última capa es la Cadence: el ritmo propio del agente. Hasta aquí, solo actuaba cuando lo llamabas: era reactivo. Cadence lo convierte proactivo: se "despierta" solo a la hora indicada y hace cosas incluso con la laptop cerrada. Es el salto de un asistente que responde a un compañero que se anticipa.
Cron / rutinas
Tareas programadas en el reloj: «todos los días a las 7 h, envíame el resumen de la agenda y los correos».
Heartbeat
Un «latido» periódico en el que el agente comprueba si hay algo que hacer y actúa por su cuenta.
Bloqueo de seguridad
Tope de iteraciones, gates de aprobación y audit log: autonomía con cinturón de seguridad.
¿Eres nuevo aquí? "Cron" es un programador clásico de computadora: activa una tarea en horarios fijos. "Heartbeat" (latido) es una señal que se repite cada cierto tiempo para que el agente "se mueva" por sí solo. Y "audit log" es un diario forense: cada acción que realiza queda registrada, para que después puedas auditar qué pasó y por qué.
⚠️ Cadence sin freno es peligrosa
Dar autonomía horaria a un agente sin límite de iteraciones ni confirmación para acciones peligrosas es como dejar suelto a un robot con las llaves de casa. La regla de oro: cada Cadence viene acompañada de controles de aprobación y de un audit log que registra todo. La autonomía es buena; la autonomía auditable es segura.
Conceptos clave
Tareas programadas en el reloj, a horas fijas.
Pulso periódico que hace que el agente compruebe y actúe por su cuenta.
De «responde cuando lo llamo» a «avísame antes de que te lo pida».
Diario forense de cada acción; autonomía con trazabilidad.
🏛️ Reuniendo las 6 capas en una arquitectura
Ahora, el cierre. Las seis piezas de la Anatomía (Ruta 3) encajan perfectamente dentro de las cuatro capas C —y, al apilarlas en el orden correcto, el mapa suelto se convierte en UNA arquitectura coherente. Cada «C» reúne las piezas que necesita, y el conjunto se eleva como un edificio: cimientos, instalaciones, mobiliario, rutina.
Cada pieza morada de la Anatomía entra en una de las cuatro capas amber. Observa que la parte autónoma de los Agentes (línea discontinua cian) alimenta la Cadence. El resultado: no seis piezas sueltas, sino un sistema que sabe, alcanza, hace y actúa, al ritmo adecuado.
🧱 Por qué esta estructura perdura
«Tools change every 6 months. The platform and foundation we're building survive.» — Las herramientas cambian cada seis meses; la plataforma y los cimientos que construyes sobreviven.
Llegan modelos nuevos, aparecen y desaparecen MCP, y algunos canales se ponen de moda y pasan de moda. Pero las 4 C no cambian: todo Jarvis siempre necesitará saber quién es, por dónde hablar, qué hacer y cuándo actuar. Por eso inviertes en la ARQUITECTURA, no en la herramienta del momento.
🎯 Cómo usar las 4 C en la práctica
Antes de construir (o al revisar) cualquier Jarvis, pasa una lista de verificación por las cuatro capas:
- 1.Context: ¿tiene SOUL/AGENTS/USER y memoria persistente? ¿Sabe quién eres?
- 2.Connections: ¿tiene un canal seguro (Telegram + whitelist) y herramientas vía MCP?
- 3.Capabilities: ¿tiene skills útiles y puede delegar en subagentes?
- 4.Cadence: ¿actúa por su cuenta según el horario, con gates y audit log?
Conceptos clave
Las 6 piezas de la Anatomía encajan en las 4 capas C.
Las herramientas cambian; la arquitectura de las 4 C perdura.
Cuatro preguntas para validar (o planificar) cualquier Jarvis.
No seis piezas sueltas, sino un sistema que se sostiene en conjunto.
Autoevaluación (opcional): en el orden de las 4 C, ¿por qué Context va antes que Capabilities?
🎯 Resumen del módulo
Siguiente módulo:
4-3 — Operar, medir y evolucionar (confianza, costo, seguridad)