PTENES
Saltar al contenido
MÓDULO 3.1

🎚️ Modelo adecuado, la cuota rinde

Usar siempre el modelo más potente es como pedirle al director de la empresa que revise un sello. Funciona, pero acaba con la cuota. El ROTEAMENTO.md del kit indica qué modelo llamar para cada tipo de tarea.

6
Temas
~35
Minutos
Base
Nivel
Fundamento
Tipo
0 de 60%
1

Entiende por qué la cuota no equivale a dólares

El kit funciona con suscripción de Claude Code y de Codex. Pagas el plan del mes y listo. No recibes una factura por llamada.

Pero la suscripción tiene un límite de uso por período: la cuota. Cada solicitud al agente consume una parte de esa cuota. Cuando se agota, esperas a que se renueve el período.

La primera línea del runtime/ROTEAMENTO.md resume el módulo: "No uses siempre el modelo más potente. Cada llamada consume la cuota de tu suscripción."

🆕 ¿Eres nuevo aquí? Tres palabras de este módulo

  • Cuota — el límite de uso de tu suscripción durante un período. No es dinero: es cuánto puedes pedir antes de tener que esperar.
  • Modelo — la «cabeza» de la IA que responde. Claude Code tiene varias (opus, sonnet, haiku…), Codex también. Los más potentes piensan mejor y consumen más cuota.
  • Equivalente de API — cuánto costaría la misma tarea si se cobrara por uso de la API. Sirve como referencia para comparar, aunque no pagues eso.
Cuota del período (tu suscripción) m m ejecutor m super para una tarea sencilla super otra vez… m = modelo menor: bloque corto · executor: bloque mediano · super: bloque largo se acabó la cuota: espera a que comience el siguiente período

Cómo leer el diagrama: la barra morada es la cuota. Los bloques azules cortos son solicitudes al modelo más pequeño; los rojos largos son el modelo más potente usado sin necesidad. Dos llamadas innecesarias al modelo superior consumen más que varias tareas bien hechas. Los tamaños son ilustrativos, no son medidas.

✓ Cuota (lo que tienes)

  • ✓ Viene con la suscripción que ya pagas
  • ✓ Termina, pero vuelve en el período siguiente
  • ✓ Rinde más cuando cada tarea usa el modelo adecuado
  • ✓ Es lo que usa todo el kit

✗ Dólares de API (que no necesitas)

  • ✗ Cuenta separada, cobrada por uso
  • ✗ No se recupera: lo que gastaste, ya lo pagaste
  • ✗ Ninguna receta del kit depende de ella
  • ✗ En el curso aparece solo como referencia para comparar

💡 Un número real para tener una idea

El CHANGELOG del kit registra que el equipo de tres roles (módulo 3.2), al crear un archivo de una frase, gastó el equivalente a ~US$ 0,73 de API. En la suscripción, esto es cuota, no un cobro. Pero demuestra que incluso una tarea diminuta tiene un costo cuando llama a modelos grandes.

💳
Suscripción

plan mensual

⏳
Cuota

límite por período

📏
Equivalente

referencia, no factura

🎚️
Enrutamiento

modelo por tarea

2

Lee los cuatro niveles de modelo

El kit no habla de nombres de modelos sueltos. Habla de nivel del modelo: súper, principal, ejecutor y menor. Cada nivel indica cuando usar e indicar el modelo en Claude Code, en Codex y en tu computadora.

Esta es la tabla de runtime/ROTEAMENTO.md, copiada del kit:

NivelCuándoClaude CodeCodexLocal (gratis, Ollama)
superpoco frecuente: problema difícil, decisión importantefable · esfuerzo altogpt-6-astra · high—
máximoplanificar, decidir, revisar lo difícilopus · mediogpt-6-astra · mediumqwen3.8:27b
ejecutorhacer el trabajo del día a díaopus · bajo / sonnetgpt-6-sol · lowqwen3.8:27b
menortriaje, formato, verificaciónhaiku / sonnetgpt-6-lunallama3.2

Qué revisar en la tabla: la columna «Cuándo» es la que usas en el día a día. Las tres de la derecha solo indican qué nombre escribir en cada herramienta. Fíjate que gpt-6-luna, el patrón del puente del módulo 2.1, es el nivel menor.

🆕 ¿Eres nuevo aquí? «Esfuerzo» y «Local»

Esfuerzo es cuánto piensa el modelo antes de responder (bajo, medio, alto). El mismo modelo con un nivel de esfuerzo alto piensa más y consume más cuota. Local es un modelo que se ejecuta en tu propia computadora mediante Ollama: no consume cuota, pero depende de que tu máquina pueda ejecutarlo. El doctor muestra si tienes Ollama (línea ollama, marcada como opcional).

superpoco frecuente máximoplanificar, decidir, revisar lo difícil ejecutorel trabajo del día a día menortriaje, formato, verificación — empieza aquí más cuota por llamada ↑ más usado ↓

Cómo leer el diagrama: el ancho del peldaño indica cuánto debería aparecer en tu día a día. El más pequeño (morado, con brillo) es la base amplia. El super, rojo y estrecho, es una excepción: si aparece todo el tiempo, algo está mal en el enrutamiento.

🔺
super

decisión importante

🧠
máximo

planificar y revisar

🛠️
ejecutor

hacer

🔎
menor

hacer triaje y verificar

3

Empieza por lo mínimo que resuelva el problema

Regla 1 del enrutamiento: "Empieza con el mínimo que resuelve; sube solo si falla." O AGENTS.md del kit repite esto para los dos agentes: "usa el modelo más pequeño que resuelva la tarea".

En la práctica, subes un nivel a la vez y solo si hay un motivo: el nivel más bajo se equivocó, dejó pasar algo o no pudo con el tamaño.

1

Lo mínimo: dar formato y verificar

Clara quiere la lista de horarios disponibles en formato de mensaje. Eso es dar formato: un nivel menor.

2

¿Te equivocaste? Executor

Sônia pide el total por cliente del CSV del ERP. Si el más pequeño suma mal, se lo pasa al ejecutor. Ella verifica a mano que la cuenta sea correcta (módulo 2.3).

3

¿Decisión? Inicio

"¿Cómo conecto el ERP sin API al agente?" es planificar y decidir. Ahí el nivel superior se justifica.

4

Muy bien: solo si el nivel superior se atasca

Problema realmente difícil, decisión importante. Poco frecuente, como dice la tabla.

El puente de Codex ya viene así: sin que tengas que decir nada, usa gpt-6-luna, el nivel menor. Para subir, cambias la variable CODEX_MODELO solo en esa llamada.

🎯 Objetivo: llamar a Codex en el nivel más bajo y saber cómo subir un nivel

En la terminal, dentro de la carpeta del kit (puente del módulo 2.1, ya con chmod +x):

runtime/pontes/codex-exec.sh "Responda apenas PONG"

Resultado comprobado en CHANGELOG 0.1.0:

PONG

Para subir al nivel ejecutor de Codex solo en esta llamada, pon la variable al principio:

CODEX_MODELO=gpt-6-sol runtime/pontes/codex-exec.sh "Responda apenas PONG"
Cómo verificar: la primera llamada devuelve PONG usando el estándar gpt-6-luna. La variable solo tiene efecto en la línea donde aparece; en la siguiente llamada se vuelve al nivel menor.

💡 Sube con un motivo por escrito

Cuando subas de nivel, anota por qué en una línea ("el menor sumó mal el total de Padaria Lua"). Después de algunas semanas, esas líneas muestran qué tareas merecen nacer en un nivel superior.

⬇️
Empieza por lo básico

regla 1

⬆️
Sube si se equivoca

un nivel a la vez

🌙
gpt-6-luna

patrón del puente

🔧
CODEX_MODELO

cambia mediante una llamada

4

Pídele una revisión a otro modelo

Regla 3: "La revisión por otro modelo (p. ej., Claude lo hace y Codex lo revisa — receta R1) detecta errores que el mismo modelo no ve."

Es la misma lógica que pedirle a un colega que vuelva a leer tu texto. Quien lo escribió tiende a leer lo que quiso escribir, no lo que está ahí. Un modelo de otra empresa tiene otros puntos ciegos.

Claude ejecuta el trabajo codex-exec.sh Codex revisa solo lectura (N4) la revisión vuelve tú recibes las dos opiniones

Cómo leer el diagrama: la flecha azul es el puente del módulo 2.1 que lleva la solicitud a Codex. La curva violeta discontinua es la revisión que vuelve. Codex solo lee: quien decide qué se queda es Claude y, al final, tú.

🎯 Objetivo: obtener una segunda opinión de otro modelo sin salir de Claude

Abre claude en la carpeta del kit y pega (prompt de la receta R1):

Usa runtime/pontes/codex-exec.sh para pedirle a Codex que revise el archivo README.md: ¿qué resulta confuso para alguien que empieza? Después, compara con tu opinión.
Cómo verificar: Claude pide ejecutar el puente, muestra lo que respondió Codex y luego distingue en qué coinciden y en qué discrepan.

✓ Revisión por otro modelo

  • ✓ Los distintos puntos ciegos se compensan
  • ✓ El revisor puede ser de un nivel inferior
  • ✓ El desacuerdo se convierte en una pregunta para ti
  • ✓ Ya viene lista en el puente del kit

✗ El mismo modelo revisándose a sí mismo

  • ✗ Tiende a estar de acuerdo con lo que acaba de hacer
  • ✗ Repite el mismo error de lectura
  • ✗ Da una falsa sensación de "verificado"
  • ✗ Gasta cuota sin aportar una mirada nueva
👀
Otra perspectiva

regla 3

🤝
Receta R1

Claude ejecuta, Codex revisa

📖
Solo lectura

patrón del puente

⚖️
Tú decides

en los desacuerdos

5

Forma un equipo solo cuando valga la pena

Regla 2: "Un equipo de agentes solo cuando el trabajo supera el costo de armar el equipo." Un equipo (módulo 3.2) llama a varios modelos, y cada uno lee la tarea y el proyecto desde cero.

El ejemplo del propio kit muestra el costo: el equipo creó un archivo de una frase y gastó el equivalente a ~US$ 0,73 de API. Fue una excelente prueba. Para escribir una frase en el día a día, bastaría un solo agente.

Tarea¿Basta con un agente?¿Conviene usar un equipo?
Organizar los horarios libres de ClaraSí, nivel menorNo
Responder una duda sobre la POLITICASíNo
Resumen mensual del ERP de Sônia, con totales verificadosArriesgado: nadie compruebaSí: planificar, hacer y verificar
Crear el puente del sistema de un clienteArriesgadoSí

Qué revisar en la tabla: el equipo compensa cuando equivocarse sale caro y alguien debe revisar. Si la tarea cabe en una frase y el error se ve de inmediato, un solo agente basta.

⚠️ Un agente dentro de otro agente pesa más de lo que parece

Regla 4, copiada del kit: "Una llamada de agente dentro de otro agente carga las instrucciones y herramientas del proyecto. Para puentes sencillos, usa una carpeta ligera o el modo --bare de Claude." Es decir: cada llamada interna vuelve a leer las reglas de la carpeta. En una carpeta llena, eso multiplica el gasto.

💡 Pregunta rápida

Antes de formar un equipo, pregúntate: "si el agente se equivoca en esto, ¿me doy cuenta de inmediato?". Si te das cuenta, usa un solo agente. Si no, el revisor del equipo vale la cuota.

👤
Un agente

tarea corta

👥
Equipo

trabajo mayor que el costo

📦
Carpeta compacta

menos para volver a leer

💸
~US$ 0,73

equivalente de la R2

6

Mantén la tabla actualizada

La última línea de ROTEAMENTO.md avisa: "Los nombres de los modelos cambian. Comprueba con claude --help e codex --help y actualiza esta tabla."

Los niveles se quedan. Lo que cambia es el nombre dentro de cada celda. Por eso las recetas hablan de "nivel inferior" y no de un nombre fijo.

🎯 Objetivo: ver qué modelos aceptan hoy tus herramientas

En la terminal, un comando a la vez:

claude --help
codex --help

O deja que el agente compare. Abre claude en la carpeta del kit y pega:

Rode claude --help e codex --help, compare com a tabela de runtime/ROTEAMENTO.md e me diga quais nomes de modelo mudaram. Não edite o arquivo: proponha a mudança numa linha da tabela Aprendizado da runtime/POLITICA.md.
Cómo verificar: en la ayuda, busca la opción de modelo (la que elige el modelo de la llamada). Si el agente propuso algo, la fila aparece en la tabla Aprendizaje con el estado "propuesto", y el ROTEAMENTO.md sigue igual hasta que lo apruebes.
1 · verificar--help de las dos CLIs 2 · proponerlínea en Aprendizaje 3 · tú apruebassí o no 4 · actualizarROTEAMENTO.md los cuatro niveles no cambian; solo cambia el nombre dentro de cada celda

Cómo leer el diagrama: la caja morada con brillo eres tú. El agente revisa y propone, pero no modifica por su cuenta el archivo de reglas. Es el «propone → aprueba → incorpora» de la POLITICA.md, que ves a fondo en el módulo 4.2.

Prueba rápida (opcional): Sônia solo quiere organizar en una tabla el total por cliente que ya verificó. ¿Qué nivel usar?

❓
--help

fuente del nombre actual

🏷️
Nivel fijo

el nombre cambia

📝
Aprendizaje

el agente propone

✅
Tú apruebas

y solo entonces cambia

🎓 Resumen del módulo

✓
La cuota no es un dólar — es el límite de la suscripción, y cada llamada consume una parte.
✓
Cuatro niveles — super, topo, executor y menor, con el nombre en cada herramienta.
✓
Empieza por lo más pequeño — y sube con CODEX_MODELO solo si se equivoca.
✓
Revisión por otro modelo — Claude lo hace, Codex lo revisa.
✓
Equipo solo cuando convenga — y la tabla se verifica con --help.

Próximo módulo:

3.2 — Equipo de tres roles