Mapa de la ruta de aprendizaje
🛡️ Seguridad
Principio de menor acceso
⭐ Northstar (Goals)
No se detiene hasta alcanzar la meta
👥 Subagentes
Equipo en paralelo
💓 Heartbeat / Cron
Trabaja mientras duermes
💰 Presupuesto y tokens
El 73% es sobrecarga fija
🌐 Operating System
El sistema de todo
🔗 One Brain
Hermes + Claude Code
Contenido detallado
🛡️ Seguridad · Principio del menor acceso
Las reglas de la casa: darle al agente solo lo que necesita y nunca exponer secretos en el chat.
A diferencia de un chatbot, el agente puede enviar correos, modificar archivos y actuar en tu computadora. El acceso real exige cuidado real.
Antes de activar cualquier poder nuevo, debes entender qué puede salir mal.
No entregues las llaves del reino; activa capacidades poco a poco.
Dale al agente solo el permiso que exige la tarea, nada más. Esto aplica a Hermes y a cualquier sistema.
Si algo sale mal, el daño queda contenido al mínimo.
Leer ≠ escribir ≠ enviar; empieza con restricciones y amplíalas según sea necesario.
Habilita "leer correo" ahora, pero espera para "enviar/responder correo" hasta confiar en el comportamiento.
Un envío equivocado es irreversible; leer es seguro.
Deja las acciones irreversibles para el final; primero prueba en modo de solo lectura.
El chat se guarda e indexa en la memoria; un secreto que pegues allí queda registrado, más aún si hay una copia de seguridad diaria.
Filtrar la clave da acceso a tu modelo y a tu dinero.
Usa variables de entorno; si se filtró, rótala de inmediato.
Cuando el agente pide acceso, tú decides: permitirlo una vez, durante la sesión o bloquearlo definitivamente.
Cada nivel intercambia conveniencia por control.
"Once" para lo desconocido; "never" para lo peligroso.
Los mismos principios te protegen en cualquier agente o sistema de IA, no solo en Hermes.
El hábito de seguridad se puede transferir y te acompaña.
Acceso mínimo + secretos fuera del chat = base segura.
⭐ Northstar (Goals) · No pares hasta alcanzar la meta
En lugar de pregunta→respuesta, tú das una dirección y el agente trabaja por turnos hasta alcanzar el objetivo.
Defines una meta y toda la conversación pasa a existir para alcanzarla, no para responder algo aislado.
Es cómo convertir un chat en un miniproyecto con propósito.
Objetivo > respuesta única; el agente persigue el objetivo, no solo reacciona.
Al recibir /goal, Hermes firma un presupuesto de alrededor de 20 turnos para llegar a la decisión.
Saber el límite ayuda a calibrar el tamaño de la meta.
Hace preguntas, no se queda en un bucle; converge dentro del presupuesto.
Para metas demasiado grandes, la skill super goals genera de 4 a 10 acciones (tuyas y del agente) con una barra de progreso.
No todas las metas caben en 20 turnos; super goals las divide en etapas.
Mission control en el dashboard; progreso visible.
Comandos para iniciar, pausar y limpiar una meta en cualquier momento.
Mantienes el volante incluso en una tarea autónoma.
Pausar guarda el estado; borrar reinicia el objetivo.
Los chief wickham loops son metas que duran semanas, para planificar la vida y no solo un proyecto corto.
Conecta el corto plazo (turnos) con el largo plazo (vida).
Bucle recurrente de revisión; horizonte de semanas.
Los Goals son útiles cuando hay que tomar una decisión o entregar un proyecto corto, no para preguntas aisladas.
Usar goal para todo desperdicia turnos.
Decidir entre A y B es un caso ideal; «qué hora es» no lo es.
👥 Subagentes · Equipo en paralelo
Hermes inicia varios subagentes con contexto nuevo y delega tareas: 6 trabajando juntos hacen en 1h lo que tomaría 6h.
En lugar de hacerlo todo en un único hilo, Hermes se convierte en un orquestador que reparte el trabajo entre auxiliares.
Las tareas grandes se vuelven viables cuando se convierten en varias pequeñas.
Orquestador + ejecutores; dividir para conquistar.
Cada subagente nace con su propia ventana de contexto limpia, enfocada solo en su subtarea.
Contexto reducido = mejores respuestas y menor costo.
El aislamiento evita confusiones entre tareas.
De 4 a 6 agentes investigan al mismo tiempo y entregan todo junto al final, en vez de hacerlo uno después de otro.
El paralelismo es la jugada de un usuario avanzado que comprime el tiempo.
Amplitud > profundidad cuando las tareas son independientes.
"Investiga las mejores empresas de IA" activa 2 subagentes: uno cubre EE. UU. y otro el mercado internacional.
Muestra cómo dividir un alcance amplio en partes claras.
División por dimensión (región, tema); unión al final.
El cofundador de Hermes ejecuta 12 instancias paralelas todos los días para construir el propio Hermes (issues, dogfooding, kanban).
Es la prueba de que el paralelismo escala mucho más allá de 2 o 3.
Dogfooding a escala; una flota de agentes.
Cada agente puede tener un rol: investigación, escritura, diseño, scheduler, como funciones en un equipo real.
Los roles claros evitan que dos agentes hagan lo mismo.
Especialización; cada rol con su modelo ideal.
💓 Heartbeat / Cron · Trabaja mientras duermes
El latido que mantiene al agente activo 24/7 y las tareas programadas que se ejecutan solas.
Un cron job que mantiene al agente activo todo el tiempo, en vez de solo reaccionar cuando le hablas.
Es lo que distingue a un chatbot de un agente que opera por su cuenta.
Pulso periódico; presencia continua.
Un subagente hace ping cada pocos segundos para detectar procesos "zombis" (detenidos) y recuperarlos.
Sin esto, una tarea bloqueada quedaría detenida para siempre.
Detección de bloqueos; reasignación a un agente nuevo; reintentos.
Programas una acción para que se ejecute en un intervalo: "recuérdame en 30s que el cielo es azul".
Automatiza recordatorios y rutinas sin que tengas que abrir la app.
Programación por tiempo; se activa solo.
Todos los días a las 8 h, Hermes revisa el correo electrónico + el calendario + lo que sabe de ti y entrega 5 elementos importantes.
Muestra cómo cron + memoria se convierten en un asistente proactivo.
Agregación de fuentes; selección diaria.
Con heartbeat, el agente hace check-in de forma proactiva: "pregúntame cosas periódicamente".
Invierte la relación: te busca, no solo responde.
Proactividad; iniciativa del agente.
Cada activación consume tokens; demasiadas programaciones generan costos y notificaciones excesivas.
Se conecta con el módulo de presupuesto (3.5).
Frecuencia a medida; revisa los crons activos.
💰 Presupuesto y tokens · 73% es sobrecarga fija
El secreto sucio de los agentes: la mayor parte de cada request es un costo fijo. Saberlo cambia cómo operas.
Cerca del 73% de cada request es sobrecarga fija (system prompt, herramientas, memoria); solo ~27% es tu pregunta.
Explica por qué las preguntas cortas todavía cuestan caro.
Costo base alto; cada llamada paga el «peaje».
La cuenta rápida: ~10 tokens equivalen a cerca de 7 palabras (≈70-75%).
Te da una idea del tamaño antes de enviar un texto enorme.
Token ≈ fragmento de palabra; estimarlo es fácil.
Limpia la sesión con frecuencia, usa el modelo adecuado, no acumules skills inútiles y mantén breves los system prompts.
Pequeños hábitos reducen la cuenta a la mitad.
Una conversación, una meta; siempre empezar de nuevo con el contexto limpio.
Alguien consumió 4 millones de tokens en 2h de uso ligero; otra persona gastó 21.000 solo por preguntar el clima debido a un error.
Con una API key, el dinero desaparece rápido si no vigilas.
Un bucle descontrolado sale caro; monitorea el uso.
Sé específico con el modelo: razonamiento complejo con el caro, volumen con el barato o gratis.
La elección equivocada multiplica el costo sin aportar beneficios.
Caro solo donde vale la pena; barato en el resto.
Define un límite (ej.: US$10/mes) y el sistema se detiene al alcanzarlo.
El límite es la red de seguridad contra sorpresas en la factura.
Límite estricto; alerta antes de excederlo.
🌐 Operating System · El sistema de todo
Hermes no es solo un chatbot: es un panel único para gestionar personas, memoria, gastos, metas y conexiones.
Hermes puede ser la capa donde gestionas TODA tu IA en un solo lugar: el «everything of AI».
Cambia la mentalidad de «app de chat» a «sistema operativo».
Un hub, no una función aislada.
Pantheon muestra tus personas (cada una con su job y modelo) de forma visual dentro del OS.
Ver las personas en un solo lugar facilita elegir quién usa qué.
Personas en tarjetas; modelo por persona.
Una bóveda de memoria que recupera cualquier correo, reunión o nota; también puedes conectar NotebookLM.
Centraliza el conocimiento que el agente puede consultar.
Recall universal; fuentes conectables.
De un vistazo: conexiones disponibles, modelo en uso, memoria, gasto en IA, mejoras con skills y uso en tiempo real.
Operar sin panel es volar a ciegas.
Vista única; métricas en vivo.
El OS «sueña» con mejoras por la noche y vuelve con sugerencias proactivas al día siguiente.
El sistema evoluciona solo, sin que se lo pidas.
Autooptimización; ideas mientras duermes.
Conecta el OS con GitHub para hacer una copia de seguridad diaria de todo Hermes; si pierdes la PC, restaura todo.
Tu OS es demasiado valioso para que desaparezca con el hardware.
Snapshot diario; restauración completa.
🔗 One Brain · Hermes + Claude Code
Conectar el cerebro de Hermes con Claude Code: la memoria y la comprensión compartidas completan los 21 conceptos.
La idea central es conectar la marca/cerebro de Hermes con Claude Code para que compartan contexto.
Dos agentes aislados repiten trabajo y se contradicen.
Una mente, dos herramientas; puente de contexto.
Hermes conoce tus proyectos, clientes y decisiones, y está presente en todas partes; Claude Code es la herramienta de precisión para construir.
Cada uno destaca en un rol; saberlo evita usar la herramienta equivocada.
Contexto amplio vs. precisión; ubicuo vs. enfocado.
Conectados, ambos acceden a lo que hizo cada uno; lo que dices en un lado llega al otro.
La memoria compartida es lo que hace significativa la conexión.
Estado compartido; sin silos.
Si le dices una cosa a Hermes y otra a Claude Code, sin conexión, divergen.
Las discrepancias generan retrabajo y decisiones inconsistentes.
Silo = contradicción; puente = coherencia.
Este es el concepto #21: conecta todo lo anterior en una visión única.
Ver todo te prepara para operar de verdad.
Del agente al OS; todo conectado.
Con los 21 conceptos a mano, el siguiente paso es armar tu propio sistema operativo de IA.
La teoría sin práctica no se convierte en operación.
Empieza con poco; conecta; itera.