⚖️ Grandes poderes, grandes responsabilidades
En los recorridos 1 y 2 viste cómo Hermes adquiría capacidades: acciones en la computadora, integraciones, MCPs, memoria. Cada una de estas es una puerta al mundo real. Un chatbot que se equivoca te da una respuesta mala; un agente que se equivoca puede enviar un email equivocado al cliente equivocado o borrar un archivo. La diferencia no es de grado, sino de naturaleza.
🧭 La mentalidad correcta
Piensa en el agente como un pasante muy rápido y muy literal. No le das al pasante de su primer día la contraseña bancaria de la empresa. Le das tareas pequeñas, observas y solo amplías el acceso cuando confías en él.
- •Activa capacidades una a la vez, no todas durante la configuración.
- •Observa el comportamiento antes de darle acceso a acciones irreversibles.
- •Trata cada nuevo poder como una decisión consciente, no como una opción predeterminada.
Los errores tienen efectos en el mundo real.
Una capacidad a la vez.
Confía después de verlo actuar.
Cada poder es una decisión.
🔐 El principio del menor acceso
En seguridad, esto tiene un nombre: least privilege (menor privilegio). La regla es sencilla: cada parte de un sistema debe tener el mínimo de acceso necesario para hacer su trabajo, y nada más. Esto aplica a Hermes, a tu celular y a tu cuenta bancaria. Es el principio de seguridad más universal que existe.
Diagrama ilustrativo · cada anillo hacia afuera representa más poder y más riesgo
📐 Los tres niveles de acceso
- Leer — el agente solo observa (ver el correo, leer un archivo). Riesgo bajo, reversible.
- Escribir / editar — crea o modifica (redactar un email, guardar un archivo). Riesgo medio.
- Enviar / borrar — acciones irreversibles en el mundo. Riesgo alto, déjalas para el final.
📧 El caso del envío de correo electrónico
El ejemplo clásico, y donde más gente salió perjudicada: conectas Gmail y, entusiasmado, permites todo — incluso enviar. En un briefing matutino automático, el agente interpreta mal una instrucción y envía un email a la lista equivocada. No se puede «deshacer» un email enviado.
✓ Empieza por aquí
- ✓Conectar lectura de email (resumir la bandeja de entrada).
- ✓Dejar que el agente redactar respuestas para que las revises.
- ✓Observar durante días si las lecturas son correctas.
✗ Evita al inicio
- ✗Permitir envío automático sin revisión humana.
- ✗Dar acceso de envío dentro de un cron 24/7 sin supervisión.
- ✗Confiar en "lo entendió" sin haberlo probado en modo de solo lectura.
💡 Consejo práctico
Regla de oro: acciones irreversibles al final. Email, transferencia, eliminación: solo después de que el agente haya demostrado, en modo de lectura/borrador, que entiende lo que quieres.
🔑 Nunca pegues API keys en el chat
¿Recuerdas la memoria (Ruta 2)? Cada mensaje de cada sesión es indexada y guardada. Si pegas una API key en el chat, se vuelve parte permanente de la memoria; peor aún si activaste el backup diario en GitHub: ahora el secreto está versionado. El lugar de un secreto es una variable de entorno, no el chat.
Forma correcta de agregar una clave (ilustrativo)
🚨 Atención
Si ya pegaste una clave en el chat, considérala comprometida: rótala de inmediato. Al rotar, la clave antigua deja de funcionar para siempre, exactamente lo que quieres.
🚦 Allow once / session / never
Cuando el agente necesita un permiso nuevo, pregunta. Tú eliges entre tres niveles, y cada uno cambia comodidad por control. Piensa en ellos como una puerta con tres aperturas.
Allow once — permitir una vez
Para algo desconocido o puntual
El agente realiza la acción esta vez y vuelve a preguntar la próxima. Máximo control, mínima comodidad. Úsalo para aquello en lo que aún no confías.
Allow session — permitir durante la sesión
Para tareas repetitivas en el mismo trabajo
Es válido mientras dure la sesión; al reiniciarla, vuelve a pedirlo. Es un buen equilibrio para una tarea que repite la misma acción varias veces.
Never — bloquear por completo
Para lo que es peligroso o no deseado
El agente nunca vuelve a preguntar ni a ejecutar. Úsalo para acciones que decidiste que jamás debe realizar.
✅ El uso responsable aplica a toda IA
Lo mejor de la seguridad es que es transferible. El hábito que creas con Hermes —acceso mínimo, secretos fuera del chat, acciones irreversibles al final— te protege en cualquier agente, plugin o sistema de IA que uses de ahora en adelante.
🧠 Consejo práctico
Antes de activar cualquier poder nuevo, hazte tres preguntas: (1) ¿es reversible? (2) ¿cuál es el peor caso? (3) ¿ya lo probé en modo de lectura? Si se bloquea en alguna, todavía no es el momento.
Solo lo necesario.
Env, nunca en el chat.
Envío; eliminación después.
Aplica a toda IA.
📌 Resumen del módulo
Próximo módulo:
3.2 - ⭐ Northstar (Goals): darle un rumbo al agente para que lo siga hasta alcanzar la meta.