🧩 Framework vs. cerebro
Hermes es el framework agéntico (la estructura que actúa); el "cerebro" es un modelo conectable. El comando /model cambia este cerebro sin tocar el resto.
Cambiar de cerebro (ilustrativo)
/model opus-4.8 ← raciocínio pesado /model gpt ← volume geral /model deepseek ← quase de graça
🧬 Model-agnostic
Como el framework no depende de un modelo específico, tienes libertad para usar el mejor cerebro para cada tarea. Esa separación es el corazón de la estrategia multi-brain.
🧠 Para razonar: Opus con un límite
Para un razonamiento complejo, usa Opus 4.7/4.8 vía OpenRouter, con límite de gasto (por ejemplo: US$10/mes y se detiene). Usa un modelo caro solo cuando valga la pena.
📊 Cómo controlar el costo
- •Define un límite mensual (ej.: US$10) — cuando lo alcance, se detiene
- •Reserva Opus para tareas difíciles, no para todo
- •Accede a través de OpenRouter para comparar costos fácilmente
💡 Consejo práctico
El límite de gasto es tu red de seguridad. Sin él, un razonamiento intenso puede hacerte gastar dinero rápidamente (ver Trilha 3, módulo de budget).
⚡ Para volumen: GPT y Grok
Para tareas generales de alto volumen: usa GPT (tu ChatGPT mediante OAuth aprovecha la suscripción de US$20) o Grok (por ejemplo, con X conectado, busca en Twitter).
GPT vía OAuth
Conecta tu ChatGPT y aprovecha la suscripción de US$20 que ya pagas.
Grok + X
Bueno para volumen y, con X conectado, búsqueda directa en Twitter.
💡 Consejo práctico
Usa lo que ya tienes contratado. Conectar ChatGPT mediante OAuth (módulo 1.5) convierte la suscripción existente en el «cerebro de alto volumen» de Hermes.
🆓 Casi gratis: DeepSeek y free
DeepSeek y modelos free cuestan casi nada. El dato que importa: el DeepSeek V4 flash entrega ~95% del rendimiento por ~1% del costo.
📊 El número que lo cambia todo
- ~95% del rendimiento de un modelo de última generación
- ~1% del costo
- Ideal para autopilot y tareas de fondo de gran volumen
✓ Usa un modelo económico en
- ✓Tareas en segundo plano, en volumen
- ✓Autopilot y automatizaciones repetitivas
- ✓Cuando 95% ya es suficiente
✗ Evita en
- ✗Razonamiento de alto impacto
- ✗Decisiones críticas en las que importa un 5%
- ✗Tareas que requieren el mejor cerebro
🔌 OpenRouter: un centro, muchos modelos
O OpenRouter es 1 conexión que da acceso a cientos de modelos, con rankings de rendimiento y costo para comparar antes de elegir.
🗺️ Por qué centralizar
- •Una clave/conexión para muchos modelos
- •Los rankings ayudan a encontrar la mejor relación calidad-precio
- •Cambiar de modelo (
/model) se vuelve trivial
Dónde comparar
# rankings de modelos (performance × custo) openrouter.ai/models
🔨 "Para un martillo, todo es un clavo"
Usar un solo modelo para todo es como tener un solo martillo: todo se vuelve un clavo. La estrategia multi-brain consiste en variar la herramienta según la tarea.
Razonamiento difícil → Opus
Con un límite de gasto, en lo que realmente importa.
Volumen general → GPT/Grok
Aprovechando las suscripciones que ya tienes.
Tareas en segundo plano → DeepSeek/free
~95% del rendimiento por ~1% del costo.
💡 Consejo práctico
Piensa en Hermes como una caja de herramientas, no como un martillo. Cambiar de cerebro según la tarea es lo que da el mejor resultado al menor costo.
🧯 Errores comunes al elegir el modelo
La mayoría de los costos desperdiciados se deben a usar el cerebro equivocado para la tarea. Mira qué hacer y qué evitar.
✓ Hazlo
- ✓Modelo costoso solo en tareas de alto impacto
- ✓Define un límite de gasto en Opus
- ✓Consulta rankings antes de elegir
✗ Evita
- ✗Usar Opus para todo (cuesta mucho dinero)
- ✗Ignorar las suscripciones que ya pagas
- ✗Fijarse en un único modelo (el "martillo")
Guía de bolsillo (ilustrativo)
raciocínio difícil -> Opus 4.7/4.8 (teto US$10/mês) volume geral -> GPT (OAuth) / Grok (com X) tarefa de fundo -> DeepSeek V4 flash (~95% perf, ~1% custo) acesso a tudo -> OpenRouter (1 conexão, rankings)
📌 Resumen del módulo
Próximo módulo:
1.7 — Local y privado