PTENES
MÓDULO 2-2

🏠 La familia en casa: OpenClaw, GravityClaw, Hermes e Intelecto

En el módulo anterior aprendiste a comparar sistemas. Ahora vamos a conocer la «familia» que nació de una idea común —un asistente personal que ejecutas y gobiernas— y a ver, lado a lado, qué acertó y qué falló cada uno. Desde el gigante popular (y peligrosamente expuesto) hasta el antiframework de 3.000 líneas, y la lección de seguridad que lo conecta todo.

6
Temas
~35
Minutos
Principiante
Nivel
Panorama
Tipo
1

🦾 OpenClaw, el original

Toda familia tiene un hermano mayor que abrió el camino, y aquí se llama OpenClaw. Lanzado a principios de 2026, se convirtió en un fenómeno: superó los 250 mil estrellas en GitHub (una «estrella» equivale a un «me gusta» de los desarrolladores), lo que demuestra que mucha gente quería lo mismo: un asistente personal de IA que conversa, recuerda y actúa, bajo tu control y no dentro del chatbot cerrado de una empresa.

OpenClaw ofrecía prácticamente todo lo que imaginas en un “Jarvis”: varios canales (las formas de hablar con él —Telegram, web, voz), el bucle de herramientas (el ciclo en el que el asistente decide llamar a una herramienta, lee el resultado y sigue), memoria, voz y un catálogo enorme de 700+ skills de la comunidad (recetas listas que cualquiera podía descargar). Tenía hasta heartbeat — un «latido» automático que hace que el agente se despierte solo cada cierto tiempo para las tareas programadas. Ambicioso y completo. El problema no era la visión, sino el precio que exigía.

📊 OpenClaw en cifras

  • •250.000+ estrellas — explosión de popularidad a principios de 2026.
  • •700+ skills de la comunidad: cualquiera podía publicar y descargar recetas.
  • •100 mil+ líneas de código — potente, pero demasiado grande para que alguien lo lea de principio a fin.
  • •US$ 500 a US$ 5.000 por mes — con un uso intensivo, la factura de la nube podía dispararse.

⚠️ El lado oscuro del éxito

La popularidad dejó al descubierto dos heridas. Primera: OpenClaw iniciaba un servidor web (un programa que se queda escuchando conexiones por internet). Un análisis encontró 42.665 instancias públicas en la red abierta, y 93,4% de ellas sin ninguna contraseña. Era como dejar la puerta de casa abierta de par en par para que cualquiera entrara y usara (o leyera) tu asistente.

Segundo: el catálogo abierto de skills se convirtió en un vector de ataque. Los investigadores encontraron 341 skills maliciosas — recetas que parecían útiles, pero robaban datos o ejecutaban comandos peligrosos. Confiar en el código de un desconocido salió caro.

¿Eres nuevo aquí? «Skill» es una receta empaquetada — un archivo que enseña al asistente a realizar una tarea repetitiva (ej.: «resumir mi día»). «Heartbeat» es un disparador de tiempo que hace que el agente actúe por su cuenta sin que se lo pidas. Y «instancia expuesta» quiere decir una copia del programa accesible desde la internet pública, en vez de estar solo en tu máquina.

Conceptos clave

El original

OpenClaw abrió la categoría de "Jarvis personal" para las masas.

Servidor web expuesto

42.665 instancias públicas, 93,4% sin contraseña — la mayor brecha.

Skills de terceros

700+ útiles, pero 341 maliciosas escondidas entre ellas.

Engorde

100K+ líneas y hasta US$5K/mes: poder con costos y riesgos altos.

2

🛡️ GravityClaw, lean y seguro

Si OpenClaw fue el hermano ambicioso y expuesto, el GravityClaw y es la respuesta breve y cuidadosa. Es una reimplementación (una reescritura desde cero de la misma idea) hecha en TypeScript, con un lema que lo resume todo: "un agente personal lean, seguro y totalmente comprendido". «Lean» significa ligero: solo lo necesario. Y «totalmente comprendido» es la parte más importante: código lo bastante pequeño para que tú mismo puedas leer y entender cada parte.

La primera gran decisión de GravityClaw fue cerrar la puerta que hundió a OpenClaw: solo Telegram, y por long-polling. El long-polling es una técnica en la que TU programa se conecta al servidor de Telegram para preguntar "¿hay algún mensaje nuevo?", en vez de abrir un servidor web y esperar a que todo el mundo toque a tu puerta. El efecto práctico: cero puertos abiertos en internet: esas 42.665 instancias expuestas simplemente no pueden ocurrir aquí.

OpenClaw · servidor web expuesto internet entera puerta abierta 93,4% sin contraseña GravityClaw · sondeo largo, sin puertos tu agente cero puertos "¿hay algún mensaje?" Telegram

A la izquierda, OpenClaw abre una puerta y toda internet puede atacarla; a la derecha, GravityClaw solo se conecta a Telegram preguntando si llegó un mensaje: nadie puede iniciar una conexión con él. La misma función, con el riesgo opuesto.

La segunda decisión fue sobre las herramientas. En lugar del catálogo de skills de desconocidos que contaminó OpenClaw, GravityClaw es solo MCP. MCP (Model Context Protocol) es un estándar abierto, creado por Anthropic, para conectar herramientas con agentes. Piensa en él como el "USB de las herramientas de IA": cada integración es un conector estandarizado y auditable (que puedes inspeccionar). El resto es coherente con la filosofía: costo fijo (cerca de US$200) o ejecutándose localmente, y está construido brick-by-brick — ladrillo por ladrillo, cada pieza probada antes de pasar a la siguiente.

✓ Lo que elige GravityClaw

  • ✓Solo Telegram, mediante long-polling: cero puertos abiertas.
  • ✓Solo MCP: herramientas estandarizadas y auditables.
  • ✓Costo predecible (~US$200 fijo) o 100% local.
  • ✓Código conciso que te resulta fácil de entender.

✗ Lo que rechaza a propósito

  • ✗Servidor web expuesto a Internet.
  • ✗Descargar skills de autores desconocidos.
  • ✗Cuenta en la nube que puede dispararse a US$5K.
  • ✗100 mil líneas que nadie puede auditar.

Conceptos clave

Reimplementación lean

La misma idea de OpenClaw, reescrita de forma concisa en TypeScript.

Long-polling

Preguntas a Telegram; nadie toca a tu puerta. Cero puertas.

Solo MCP

Herramientas mediante un estándar auditable, en lugar de skills de terceros.

Brick-by-brick

Construir ladrillo por ladrillo, entendiendo cada pieza.

3

🪶 Intelecto, el anti-framework

Si GravityClaw es ligero, el Intelecto lleva el «menos es más» al extremo. Se llama anti-framework: mientras que un framework es una estructura grande y genérica que adoptas completa (y rara vez lees), Intelecto es lo opuesto: alrededor de 3.000 líneas de Python, sin Docker, sin panel web, sin capas que ocultan el funcionamiento. La tesis es provocadora: el código que entiendes vale más que el código que clonas y nunca lees.

🧩 Las decisiones del Intelecto

Cada decisión del proyecto apunta a la simplicidad y al control:

  • •Canal: solo Telegram, como toda la familia: simple y sin puertos expuestos.
  • •Memoria: archivos de texto + un índice SQLite FTS5/BM25 para búsqueda rápida.
  • •Personalidad: tres archivos — SOUL, AGENTS e USUARIO.
  • •Cerebro: nube (vía OpenRouter) o local (vía Ollama), tú eliges.

Vale la pena desglosar dos puntos. La memoria usa SQLite FTS5 con BM25: SQLite es una base de datos que cabe en un único archivo; FTS5 es su módulo de «búsqueda de texto completo»; y BM25 es la fórmula clásica que ordena los resultados por relevancia (la misma idea detrás de un buscador). En otras palabras: encuentra rápido la nota correcta entre miles, sin un servicio externo. En cambio, la personalidad vive en archivos legibles: o SOUL.md guarda quién es él (valores, tono de voz); el AGENTS.md, lo que siempre o nunca hace; y el USUARIO, quién eres. Editas el "alma" del asistente en un editor de texto, sin programar.

¿Eres nuevo aquí? "Framework" es una estructura de software lista y genérica que adoptas por completo. "SQLite" es una base de datos ligera, guardada en un solo archivo. "OpenRouter" es un portal que da acceso a varios modelos en la nube con una sola clave; "Ollama" es el programa que ejecuta modelos en TU computadora, gratis. "SOUL.md" es simplemente un archivo de texto con la personalidad del asistente.

Conceptos clave

Antiframework

~3.000 líneas que lees completas, sin Docker ni web UI.

FTS5 / BM25

Búsqueda de texto clasificada por relevancia, dentro del propio SQLite.

SOUL / AGENTS / USER

Personalidad, reglas y perfil: todo en archivos editables.

Nube o local

OpenRouter (nube) u Ollama (local), intercambiables sin reescribir.

4

💊 Antidote

O Antídoto y es pariente cercano de Intelecto: mismo proyecto, misma stack, en una etapa aún más sencilla. Piensa en él como una versión «destilada» de la misma idea. Dos características lo hacen interesante para quienes están empezando: genera un archivo .md que es 100% tool-agnostic, y él viene con una guía de build paso a paso.

Tool-agnostic quiere decir "que no depende de una herramienta específica". Antidote genera la descripción de tu asistente como un documento de texto común (.md, formato Markdown) — y ese mismo archivo se puede usar dentro de Codex, Gemini, Cursor o cualquier otro entorno de IA. En vez de atarte a un programa, te ofrece una receta portátil que viaja entre plataformas.

1

La misma raíz de Intelecto

El mismo stack y la filosofía de «menos es más», en una forma más reducida y directa.

2

Salida tool-agnostic (.md)

Genera un Markdown portátil que funciona en Codex, Gemini, Cursor, sin ataduras.

3

Guía de build paso a paso

Tiene documentación para construir desde cero — un buen punto de entrada para principiantes.

💡 Por qué esto te importa

Una receta tool-agnostic y un seguro contra el futuro: si cambia la herramienta de moda (y siempre cambia), la descripción de tu asistente sigue siendo válida. No tienes que reconstruir todo; solo apuntas el mismo archivo al nuevo entorno. Portabilidad es libertad.

Conceptos clave

Primo del intelecto

El mismo proyecto/stack, en una etapa más sencilla.

Tool-agnostic

No depende de una herramienta: funciona en Codex, Gemini, Cursor.

Salida en .md

Un Markdown portátil como artefacto principal.

Guía de build

Paso a paso documentado para construir desde cero.

5

🪽 Hermes / claude-hermes-os

Cuidado con confundirlos: hay dos proyectos con nombres parecidos, y hacen cosas diferentes. El Hermes y es un agente self-hosted («self-hosted» = que tú mismo alojas y ejecutas) con la marca "un cerebro, varias bocas" — un único núcleo de IA que habla por varios canales y puede usar varios modelos. En cambio, el claude-hermes-os y es otra cosa: un panel local de solo lectura (solo lectura) lo que ya tienes, sin actuar por ti.

🪽 Hermes (el agente)

Un agente completo que une las piezas y se convierte en casi todo un «SO de IA»:

  • •Memoria, personas y skills propias.
  • •Herramientas vía MCP y tareas programadas (cron).
  • •«Un cerebro, varias bocas»: varios modelos detrás de varios canales.

🖥️ claude-hermes-os (el panel)

Un observador local que LEE lo que ya usas, sin modificar nada:

  • •Lee Claude Code, Codex, OpenClaw, Obsidian, Pinecone.
  • •Muestra el gasto, una memoria en 3D y sus skills.
  • •Tiene "Dream": una mejora automática diaria de las skills.

La marca "un cerebro, varias bocas" merece atención porque es fácil entenderlo mal. No significa que varios modelos voten juntos para dar una respuesta. Significa que el el motor de IA es intercambiable: puedes conectar un modelo local económico para tareas simples y un modelo potente en la nube para las difíciles — y el mismo Hermes habla por Telegram, web o voz (las "bocas"). Un núcleo, muchas salidas. Y es "Dream" del panel es un detalle encantador: una rutina que, todos los días, revisa y refina las recetas (skills) que usaste, como si el sistema "durmiera y organizara lo aprendido".

¿Eres nuevo aquí? «Self-hosted» = se ejecuta en tu propio servidor/computadora, bajo tu control. «Read-only» = solo observa, nunca modifica. «Whitelist» (lo veremos en el siguiente tema) es la lista de quién tiene permiso — solo se atiende a esas personas, el resto se ignora. Y «cron» es un programador que activa tareas en horarios fijos (ej.: un resumen todos los días a las 7h).

Conceptos clave

Hermes (agente)

Self-hosted, memoria+personas+skills+MCP+cron: casi un SO de IA.

claude-hermes-os (panel)

Observador de solo lectura que lee tus herramientas y muestra gasto/memoria/skills.

Un cerebro, varias bocas

Motor intercambiable + varios canales — no es una votación de modelos.

"Dream"

Mejora diaria de las skills en el panel.

6

🔐 La lección de seguridad

Si vas a guardar una sola cosa de este módulo, que sea esta: los dos mayores desastres de la familia se debieron a seguridad, no de inteligencia. OpenClaw no falló por ser "tonto", sino por exponer un puerto (42.665 instancias abiertas) y por confiar en código de un desconocido (341 skills maliciosas). En el fondo, lo único que hicieron de manera diferente GravityClaw, Intelecto y Antidote fue cerrar esos dos agujeros.

los 2 agujeros puerta abierta · 93,4% sin contraseña skill de terceros · 341 maliciosas el camino seguro sin puertos (long-polling) solo MCP (auditable) local-first lista de permitidos 4 bloqueos que, juntos, cierran los 2 agujeros del original

A la izquierda, los dos agujeros que derribaron OpenClaw; a la derecha, los cuatro bloqueos de camino seguro. Sin puertos e local-first cierran la exposición; solo MCP e lista de permitidos cierran la confianza ciega. Fíjate: ninguna exige genialidad; requieren disciplina.

El cuarto bloqueo, la lista de permitidos, y es la más simple y la más subestimada. Es una lista de quién puede usar el asistente; normalmente, solo tu identificador de Telegram. Cualquier mensaje de otra persona se ignora en silencio. Esa es la diferencia entre un asistente que solo te atiende a ti y uno que, por descuido, atiende a todo Internet.

⚠️ El error que no debes repetir

Construir un Jarvis poderoso y emocionante, y es precisamente en ese entusiasmo donde aparece el descuido. «Déjalo expuesto solo para probar», «descargué esta skill que parecía útil»: fueron esas frases las que produjeron 42.665 puertos abiertos y 341 recetas envenenadas. La seguridad no es un módulo avanzado que puedas dejar para después; es la base, desde el primer ladrillo.

Autoevaluación (opcional): ¿qué frase resume la lección de seguridad de la familia?

Conceptos clave

Los 2 huecos

Puerto expuesto + confianza en código de desconocidos.

Sin puertos + local-first

Long-polling y ejecutar localmente cierran la exposición.

Solo MCP

Herramientas auditables en lugar de skills de terceros.

Lista de permitidos

Solo se atiende a tu ID; el resto se ignora en silencio.

🎯 Resumen del módulo

✓
OpenClaw, el original — popularizó el Jarvis personal (250K+ estrellas), pero tuvo un costo alto: una puerta expuesta, 341 skills maliciosas y hasta US$5K/mes.
✓
GravityClaw, ligero y seguro — solo Telegram mediante long-polling (cero puertos), solo MCP, costo fijo, ladrillo por ladrillo.
✓
Intelecto y Antidote — el antiframework de ~3.000 líneas (SOUL/AGENTS/USER, SQLite FTS5) y su primo destilado, con salida .md tool-agnostic.
✓
Hermes y la lección de seguridad — "un cerebro, varias bocas" + panel de solo lectura; es el camino seguro: sin puertos, solo MCP, local-first y lista de permitidos.

Siguiente módulo:

2-3 — El mundo allá afuera (AIOS, MemGPT, Operator) y el camino