PTENES
MÓDULO 3.1

🛡️ Seguridad · Principio del menor acceso

Un agente no solo habla: actúa. Envía correos, modifica archivos, gasta dinero. Por eso la primera regla de operación no es una función: es una postura. Dar el mínimo acceso, nunca exponer secretos y activar los permisos poco a poco.

6
Temas
~25
Minutos
Avanzado
Nivel
Práctica
Tipo
1

⚖️ Grandes poderes, grandes responsabilidades

En los recorridos 1 y 2 viste cómo Hermes adquiría capacidades: acciones en la computadora, integraciones, MCPs, memoria. Cada una de estas es una puerta al mundo real. Un chatbot que se equivoca te da una respuesta mala; un agente que se equivoca puede enviar un email equivocado al cliente equivocado o borrar un archivo. La diferencia no es de grado, sino de naturaleza.

🧭 La mentalidad correcta

Piensa en el agente como un pasante muy rápido y muy literal. No le das al pasante de su primer día la contraseña bancaria de la empresa. Le das tareas pequeñas, observas y solo amplías el acceso cuando confías en él.

  • •Activa capacidades una a la vez, no todas durante la configuración.
  • •Observa el comportamiento antes de darle acceso a acciones irreversibles.
  • •Trata cada nuevo poder como una decisión consciente, no como una opción predeterminada.
Actúa, no habla

Los errores tienen efectos en el mundo real.

Poco a poco

Una capacidad a la vez.

Observar

Confía después de verlo actuar.

Consciente

Cada poder es una decisión.

2

🔐 El principio del menor acceso

En seguridad, esto tiene un nombre: least privilege (menor privilegio). La regla es sencilla: cada parte de un sistema debe tener el mínimo de acceso necesario para hacer su trabajo, y nada más. Esto aplica a Hermes, a tu celular y a tu cuenta bancaria. Es el principio de seguridad más universal que existe.

Leer seguro Escribir / editar Enviar / borrar — requiere más confianza más acceso → ← menos riesgo

Diagrama ilustrativo · cada anillo hacia afuera representa más poder y más riesgo

📐 Los tres niveles de acceso

  • Leer — el agente solo observa (ver el correo, leer un archivo). Riesgo bajo, reversible.
  • Escribir / editar — crea o modifica (redactar un email, guardar un archivo). Riesgo medio.
  • Enviar / borrar — acciones irreversibles en el mundo. Riesgo alto, déjalas para el final.
3

📧 El caso del envío de correo electrónico

El ejemplo clásico, y donde más gente salió perjudicada: conectas Gmail y, entusiasmado, permites todo — incluso enviar. En un briefing matutino automático, el agente interpreta mal una instrucción y envía un email a la lista equivocada. No se puede «deshacer» un email enviado.

✓ Empieza por aquí

  • ✓Conectar lectura de email (resumir la bandeja de entrada).
  • ✓Dejar que el agente redactar respuestas para que las revises.
  • ✓Observar durante días si las lecturas son correctas.

✗ Evita al inicio

  • ✗Permitir envío automático sin revisión humana.
  • ✗Dar acceso de envío dentro de un cron 24/7 sin supervisión.
  • ✗Confiar en "lo entendió" sin haberlo probado en modo de solo lectura.

💡 Consejo práctico

Regla de oro: acciones irreversibles al final. Email, transferencia, eliminación: solo después de que el agente haya demostrado, en modo de lectura/borrador, que entiende lo que quieres.

4

🔑 Nunca pegues API keys en el chat

¿Recuerdas la memoria (Ruta 2)? Cada mensaje de cada sesión es indexada y guardada. Si pegas una API key en el chat, se vuelve parte permanente de la memoria; peor aún si activaste el backup diario en GitHub: ahora el secreto está versionado. El lugar de un secreto es una variable de entorno, no el chat.

Forma correcta de agregar una clave (ilustrativo)

# 1. pídele a Hermes un comando de terminal con un marcador de posición
export OPENROUTER_API_KEY="COLE_SUA_CHAVE_AQUI"
# 2. reemplaza el marcador de posición por la clave real EN LA TERMINAL
# 3. pégalo en la terminal — nunca de vuelta en el chat

🚨 Atención

Si ya pegaste una clave en el chat, considérala comprometida: rótala de inmediato. Al rotar, la clave antigua deja de funcionar para siempre, exactamente lo que quieres.

5

🚦 Allow once / session / never

Cuando el agente necesita un permiso nuevo, pregunta. Tú eliges entre tres niveles, y cada uno cambia comodidad por control. Piensa en ellos como una puerta con tres aperturas.

1

Allow once — permitir una vez

Para algo desconocido o puntual

El agente realiza la acción esta vez y vuelve a preguntar la próxima. Máximo control, mínima comodidad. Úsalo para aquello en lo que aún no confías.

2

Allow session — permitir durante la sesión

Para tareas repetitivas en el mismo trabajo

Es válido mientras dure la sesión; al reiniciarla, vuelve a pedirlo. Es un buen equilibrio para una tarea que repite la misma acción varias veces.

3

Never — bloquear por completo

Para lo que es peligroso o no deseado

El agente nunca vuelve a preguntar ni a ejecutar. Úsalo para acciones que decidiste que jamás debe realizar.

6

✅ El uso responsable aplica a toda IA

Lo mejor de la seguridad es que es transferible. El hábito que creas con Hermes —acceso mínimo, secretos fuera del chat, acciones irreversibles al final— te protege en cualquier agente, plugin o sistema de IA que uses de ahora en adelante.

🧠 Consejo práctico

Antes de activar cualquier poder nuevo, hazte tres preguntas: (1) ¿es reversible? (2) ¿cuál es el peor caso? (3) ¿ya lo probé en modo de lectura? Si se bloquea en alguna, todavía no es el momento.

Acceso mínimo

Solo lo necesario.

Secretos fuera

Env, nunca en el chat.

Lo irreversible, al final

Envío; eliminación después.

Transferible

Aplica a toda IA.

📌 Resumen del módulo

✓
Actúa, no habla - los errores del agente tienen efectos reales, por eso la seguridad va primero.
✓
Menor acceso - da solo lo mínimo: leer ≠ escribir ≠ enviar.
✓
Email al final - primero leer y hacer un borrador; enviar solo después de confiar.
✓
Secretos en el env - nunca pegues claves de API en el chat; si se filtraron, rótalas.
✓
Una vez / sesión / nunca - equilibra la comodidad con el control.

Próximo módulo:

3.2 - ⭐ Northstar (Goals): darle un rumbo al agente para que lo siga hasta alcanzar la meta.