PTENES
MÓDULO 1.6

🎛️ Elegir el Modelo

Hermes es un framework agéntico; el «cerebro» es un modelo intercambiable con /model. La estrategia multi-brain: el mejor modelo para cada tarea. Para un martillo, todo es un clavo, así que varía la herramienta.

🔌 OpenRouter 1 conexión Opus 4.7/4.8 GPT Grok DeepSeek / free → razonamiento → volumen (OAuth) → volumen + X/Twitter → casi gratis
6
Temas
22
Minutos
Básico
Nivel
Práctico
Tipo
1

🧩 Framework vs. cerebro

Hermes es el framework agéntico (la estructura que actúa); el "cerebro" es un modelo conectable. El comando /model cambia este cerebro sin tocar el resto.

Cambiar de cerebro (ilustrativo)

/model opus-4.8      ← raciocínio pesado
/model gpt           ← volume geral
/model deepseek      ← quase de graça

🧬 Model-agnostic

Como el framework no depende de un modelo específico, tienes libertad para usar el mejor cerebro para cada tarea. Esa separación es el corazón de la estrategia multi-brain.

2

🧠 Para razonar: Opus con un límite

Para un razonamiento complejo, usa Opus 4.7/4.8 vía OpenRouter, con límite de gasto (por ejemplo: US$10/mes y se detiene). Usa un modelo caro solo cuando valga la pena.

📊 Cómo controlar el costo

  • •Define un límite mensual (ej.: US$10) — cuando lo alcance, se detiene
  • •Reserva Opus para tareas difíciles, no para todo
  • •Accede a través de OpenRouter para comparar costos fácilmente

💡 Consejo práctico

El límite de gasto es tu red de seguridad. Sin él, un razonamiento intenso puede hacerte gastar dinero rápidamente (ver Trilha 3, módulo de budget).

3

⚡ Para volumen: GPT y Grok

Para tareas generales de alto volumen: usa GPT (tu ChatGPT mediante OAuth aprovecha la suscripción de US$20) o Grok (por ejemplo, con X conectado, busca en Twitter).

1

GPT vía OAuth

Conecta tu ChatGPT y aprovecha la suscripción de US$20 que ya pagas.

2

Grok + X

Bueno para volumen y, con X conectado, búsqueda directa en Twitter.

💡 Consejo práctico

Usa lo que ya tienes contratado. Conectar ChatGPT mediante OAuth (módulo 1.5) convierte la suscripción existente en el «cerebro de alto volumen» de Hermes.

4

🆓 Casi gratis: DeepSeek y free

DeepSeek y modelos free cuestan casi nada. El dato que importa: el DeepSeek V4 flash entrega ~95% del rendimiento por ~1% del costo.

📊 El número que lo cambia todo

  • ~95% del rendimiento de un modelo de última generación
  • ~1% del costo
  • Ideal para autopilot y tareas de fondo de gran volumen

✓ Usa un modelo económico en

  • ✓Tareas en segundo plano, en volumen
  • ✓Autopilot y automatizaciones repetitivas
  • ✓Cuando 95% ya es suficiente

✗ Evita en

  • ✗Razonamiento de alto impacto
  • ✗Decisiones críticas en las que importa un 5%
  • ✗Tareas que requieren el mejor cerebro
5

🔌 OpenRouter: un centro, muchos modelos

O OpenRouter es 1 conexión que da acceso a cientos de modelos, con rankings de rendimiento y costo para comparar antes de elegir.

🗺️ Por qué centralizar

  • •Una clave/conexión para muchos modelos
  • •Los rankings ayudan a encontrar la mejor relación calidad-precio
  • •Cambiar de modelo (/model) se vuelve trivial

Dónde comparar

# rankings de modelos (performance × custo)
openrouter.ai/models
6

🔨 "Para un martillo, todo es un clavo"

Usar un solo modelo para todo es como tener un solo martillo: todo se vuelve un clavo. La estrategia multi-brain consiste en variar la herramienta según la tarea.

🧠

Razonamiento difícil → Opus

Con un límite de gasto, en lo que realmente importa.

⚡

Volumen general → GPT/Grok

Aprovechando las suscripciones que ya tienes.

🆓

Tareas en segundo plano → DeepSeek/free

~95% del rendimiento por ~1% del costo.

💡 Consejo práctico

Piensa en Hermes como una caja de herramientas, no como un martillo. Cambiar de cerebro según la tarea es lo que da el mejor resultado al menor costo.

7

🧯 Errores comunes al elegir el modelo

La mayoría de los costos desperdiciados se deben a usar el cerebro equivocado para la tarea. Mira qué hacer y qué evitar.

✓ Hazlo

  • ✓Modelo costoso solo en tareas de alto impacto
  • ✓Define un límite de gasto en Opus
  • ✓Consulta rankings antes de elegir

✗ Evita

  • ✗Usar Opus para todo (cuesta mucho dinero)
  • ✗Ignorar las suscripciones que ya pagas
  • ✗Fijarse en un único modelo (el "martillo")

Guía de bolsillo (ilustrativo)

raciocínio difícil  -> Opus 4.7/4.8  (teto US$10/mês)
volume geral        -> GPT (OAuth) / Grok (com X)
tarefa de fundo     -> DeepSeek V4 flash (~95% perf, ~1% custo)
acesso a tudo       -> OpenRouter (1 conexão, rankings)

📌 Resumen del módulo

✓
Framework vs. cerebro — /model cambia el modelo, no lo demás.
✓
Razonamiento — Opus 4.7/4.8 con límite de gasto.
✓
Volumen — GPT (OAuth) y Grok (con X).
✓
Casi gratis — DeepSeek V4 flash: ~95% por ~1% del costo.
✓
Multi-brain — caja de herramientas, no martillo.

Próximo módulo:

1.7 — Local y privado