Mapa de la ruta de aprendizaje
🤖 Agente, no chatbot
Hace, no solo habla
🐕 Qué es Hermes
Tu perro, no el contratado
🧠 Un Cerebro, 22 Bocas
Una mente, en todas partes
🏠 Dónde vive Hermes
Local, VPS o en la nube
🔑 OAuth vs API Key
Botón para volver vs. llave
🎛️ Elegir el Modelo
Caja de herramientas, no martillo
💻 Local y privado
1000 ft bajo tierra
Contenido detallado
🤖 Agente, no chatbot
La diferencia que lo cambia todo: un chatbot te dice cómo hacerlo; un agente lo hace. Le das la meta, tiene herramientas y ejecuta.
Un chatbot te explica CÓMO reservar un vuelo; un agente lo reserva de verdad. La diferencia está en la capacidad de actuar en el mundo.
Es el concepto base de toda la Trilha 1. Sin esto, usas Hermes como otro chatbot más y desperdicias su potencial.
Dice vs. hace; consejo vs. ejecución; respuesta vs. acción completada.
Chatbot = amigo inteligente que te da consejos. Agente = asistente personal que ejecuta la tarea por ti.
La analogía deja más clara la diferencia práctica que cualquier definición técnica.
Consejos vs. delegación; tú al mando, él en la ejecución.
"Encuentra el vuelo más barato de Dubái a Toronto en las próximas 2 semanas" → investiga, elige y abre el resultado en un HTML atractivo.
Muestra el ciclo objetivo → investigación → decisión → entrega que define a un agente.
Una sola meta; varias etapas autónomas; un resultado listo para usar.
El agente tiene acceso a herramientas (Gmail, calendario, búsqueda, navegador) y actúa a través de ellas; no solo conversa.
Las herramientas son lo que transforma el texto en acción real: la esencia del agente.
Sin herramientas = chatbot; con herramientas = agente.
Hermes es una IA con herramientas, accesible desde donde estés a través del celular.
La disponibilidad móvil es lo que hace que el agente sea útil en el día a día, no solo en el escritorio.
Acceso móvil; un agente siempre a mano.
Para una duda rápida ("¿qué significa X?"), basta con un chatbot; el agente brilla cuando hay una TAREA que ejecutar.
Evita usar (y pagar) una herramienta pesada cuando una respuesta simple resuelve el problema.
Pregunta = chatbot; tarea con pasos = agente.
🐕 Qué es Hermes (y cuándo usarlo)
Dónde encaja Hermes frente a Claude Code, OpenClaw e IDEs. Es tu Labrador: vive contigo, te conoce y mejora año tras año.
Hermes es como tu perro: vive contigo, te conoce y mejora año tras año.
Define el «design ethos» de Hermes: persistencia y crecimiento a lo largo del tiempo.
Persistencia; relación a largo plazo; mejora continua.
Claude Code es el contratado: excelente para un trabajo específico, pero no vive contigo ni te lo recuerda después.
Saber la diferencia evita esperar memoria persistente de una herramienta de sesión.
Sesión vs. persistencia; herramienta de precisión vs. compañero.
OpenClaw es tu compañero de cuarto; anti-gravity es tu IDE/socio de código. Cada uno tiene un papel distinto.
Mapear el ecosistema te ayuda a elegir la herramienta adecuada para cada momento.
Roles distintos; ninguno sustituye al otro.
La esencia de Hermes: cuanto más lo usas, más aprende sobre ti y más útil se vuelve.
Crea la expectativa correcta: el valor crece con el tiempo, no el primer día.
Efecto acumulativo; valor compuesto por el uso.
Usa Hermes cuando estés en movimiento: en un café, en el gimnasio o con el celular. Usa herramientas de escritorio cuando estés en tu mesa.
Saber el contexto adecuado de cada herramienta maximiza la productividad.
Móvil = Hermes; escritorio = herramientas de desktop.
El principio de diseño de Hermes es acompañarte y mejorar con el tiempo, no ser una herramienta descartable.
Este ethos explica decisiones como la memoria local, soul y las copias de seguridad.
Compañero persistente; evolución; relación.
🧠 Un Cerebro, 22 Bocas
La misma inteligencia, accesible desde 22+ interfaces. Donde se ejecuta Hermes está el cerebro; los canales son solo bocas conectadas a él.
Donde se ejecuta Hermes (tu PC o una VPS) está el cerebro. Es la MISMA inteligencia, sin importar por dónde te comuniques con ella.
Entender que el cerebro es único explica por qué la memoria y el contexto se comparten entre canales.
Un cerebro central; interfaces conectables.
Telegram, Discord, WhatsApp, Slack, Matrix, navegador, OS propio — 22+ interfaces para la misma mente.
Hablas con el agente por el canal que ya usas, sin aprender a usar una app nueva.
Multicanal; sin una app obligatoria.
Imagina una operadora en el medio: recibe llamadas de cualquier canal y las enruta todas a tu agente.
La analogía explica cómo los mensajes de distintas fuentes llegan al mismo cerebro.
Enrutamiento central; convergencia de canales.
Como la inteligencia es central, no te quedas atado a un único software o interfaz.
Reduce la dependencia y te da flexibilidad de canal según el contexto.
Sin dependencia de un proveedor; cambio libre de canal.
Como hay un único cerebro, puedes empezar una conversación en Telegram y continuar en el navegador sin perder el hilo.
Es el beneficio práctico más inmediato de tener un cerebro central.
Continuidad entre canales; memoria unificada.
Además de las apps de chat, Hermes tiene su propio OS/dashboard como interfaz: otra boca para el mismo cerebro.
Anticipa el concepto de Operating System, que se profundiza en la Trilha 3.
OS como canal; visión unificada.
🏠 Dónde vive Hermes
Terminal, local o VPS: los tres posibles hogares de Hermes, con los trade-offs de costo, control y seguridad de cada uno.
La terminal es donde escribes comandos; local es tu propia computadora; VPS es la computadora de otra empresa que alquilas.
Sin este vocabulario, el resto del módulo (y de la instalación) no tiene sentido.
Terminal; local; VPS.
Ejecutarlo en tu PC es gratis, fácil y seguro; funciona mientras la computadora esté encendida. Mucha gente usa una MacBook vieja las 24/7.
Es la forma recomendada para empezar: cero costo de alojamiento y control total.
Gratis; debe estar encendido; máquina dedicada 24/7.
Instalas pegando el comando en la terminal (Cmd+Space → "terminal" → pegar) o pidiéndole a Claude Code que lo instale por ti.
Es el paso práctico que saca a Hermes del papel y lo pone en funcionamiento.
Comando pegado; Claude Code como instalador.
Una VPS funciona en el computador de otra empresa (hosting): la alquilas, pagas mensualmente y necesitas proteger los puertos para evitar ataques.
Es la opción para tener Hermes conectado 24/7 sin dejar encendida tu PC personal.
Alquiler mensual; tiempo de actividad; superficie de ataque.
Los proveedores de VPS suelen pagar por referidos mediante enlaces de afiliados. No todas las recomendaciones son neutrales.
Te ayuda a ser crítico al elegir proveedor y evita decisiones sesgadas.
Enlaces de afiliados; sesgo comercial.
Como funciona en tu máquina, puedes pedirle a Hermes "apaga el gateway" o "reinicia"; controla su propia infraestructura.
Muestra el poder del control local: el agente se administra a sí mismo.
Autoadministración; control mediante lenguaje natural.
🔑 OAuth vs API Key
Las dos formas de conectar un modelo a Hermes. OAuth es el botón que recuperas; la API key es la llave que guardas y puedes rotar.
Con OAuth, se abre el navegador, inicias sesión y haces clic en "Allow". La conexión queda lista, sin manejar claves.
Es la forma más sencilla y segura de conectar cuando el proveedor la ofrece.
Inicio de sesión + Allow; sin exponer la clave; revocable.
Una API key es una cadena de caracteres que reside en un servidor y da acceso a los modelos del proveedor.
Es la forma que se usa cuando no hay OAuth (p. ej., Claude) y da acceso amplio.
Cadena secreta; acceso a todos los modelos del proveedor.
Puedes rotar la API key en cualquier momento; al rotarla, la clave antigua deja de funcionar para siempre.
Es tu defensa si se filtra una clave: basta con rotarla.
Rotación; revocación inmediata de la clave anterior.
Grok y ChatGPT se conectan vía OAuth; Claude NO ofrece OAuth: solo funciona con API key.
Saber quién ofrece qué evita buscar un botón de OAuth que no existe.
OAuth: Grok, ChatGPT; API key: Claude y otros.
Ejecutas homes setup en la terminal, elige el proveedor y luego haz OAuth (reauthenticate) o pega la API key.
Es el punto exacto donde los dos métodos se encuentran en la práctica.
homes setup; elegir provider; OAuth o pegar key.
OAuth es el botón que puedes «recuperar» en cualquier momento; la API key es una clave que debes guardar y que puedes rotar.
La imagen deja clara la diferencia de responsabilidad entre los dos métodos.
Revocar vs. guardar; comodidad vs. control.
🎛️ Elegir el Modelo
Hermes es un framework agéntico; el cerebro es un modelo intercambiable. Estrategia multi-brain: el mejor modelo para cada tarea.
Hermes es el framework agéntico; el «cerebro» es un modelo conectable. El comando /model cambia este cerebro.
Separar el framework del modelo es lo que permite la estrategia agnóstica al modelo.
Framework fijo; modelo intercambiable; /model.
Para un razonamiento complejo, usa Opus 4.7/4.8 vía OpenRouter, con un límite de gasto (p. ej., US$10/mes y se detiene).
Modelo costoso solo donde vale la pena, con un límite para no exceder el presupuesto.
Opus para razonar; límite de gasto.
Para tareas generales de alto volumen, usa GPT (tu ChatGPT vía OAuth aprovecha la suscripción de US$20) o Grok (con X conectado, busca en Twitter).
Aprovecha suscripciones que ya pagas y reduce el costo por token.
GPT vía OAuth; Grok + X; volumen barato.
DeepSeek y los modelos free funcionan casi gratis. Ej.: DeepSeek V4 flash ofrece ~95% del rendimiento por ~1% del costo.
Para el piloto automático y las tareas en segundo plano, un modelo barato es la opción obvia.
~95% del rendimiento, ~1% del costo; gratis para usar en volumen.
OpenRouter es 1 conexión que te da acceso a cientos de modelos, con rankings de rendimiento y costo para comparar.
Centraliza el acceso y facilita cambiar de modelo según la tarea.
Centro único; rankings; comparación de costos.
Usar un solo modelo para todo es como tener un solo martillo: todo se convierte en un clavo. La idea es variar la herramienta según la tarea.
Es el resumen práctico de la estrategia multi-brain.
Model-agnostic; la herramienta adecuada para cada trabajo.
💻 Local y privado
Ejecutar el MODELO en tu máquina, no solo Hermes. 100% privado, funciona sin conexión: a 1000 ft bajo tierra, volando o en el espacio.
Alojado localmente aquí significa que no solo Hermes, sino también el propio MODELO de IA se ejecuta en tu máquina.
Es lo que garantiza privacidad total y funcionamiento sin conexión.
Modelo local; sin servidor externo.
Los modelos grandes tienen miles de millones de parámetros y necesitan un centro de datos. En local, tienes las limitaciones de tu hardware.
Define las expectativas: la privacidad cuesta rendimiento/velocidad.
Parámetros vs. hardware; menos rendimiento.
Ve a Apple → Acerca de esta Mac, envíale una captura de pantalla a Hermes y pregúntale «¿cuál es el modelo local más potente que puedo ejecutar?»
Es la forma práctica de descubrir qué admite tu hardware sin adivinar.
Especificaciones del hardware; recomendación según una captura de pantalla.
Descargas modelos con Ollama — ej.: Gemma, Qwen 32B/3.6 u opciones Cloud free.
Es la herramienta estándar para ejecutar modelos localmente con pocos comandos.
Ollama; Gemma; Qwen.
Como todo funciona localmente, es 100% privado y funciona sin conexión: a 1000 ft bajo tierra, volando o en el espacio.
Es el gran argumento de lo local: nada sale de tu máquina.
Privacidad total; sin conexión; sin depender de la red.
Local es adecuado cuando la privacidad o la operación sin conexión son innegociables; para obtener la máxima potencia, los modelos en la nube siguen ganando.
Ayuda a decidir entre privacidad y rendimiento según el caso.
Decisión según prioridades; privacidad vs. potencia.