Entiende por qué la cuota no equivale a dólares
El kit funciona con suscripción de Claude Code y de Codex. Pagas el plan del mes y listo. No recibes una factura por llamada.
Pero la suscripción tiene un límite de uso por período: la cuota. Cada solicitud al agente consume una parte de esa cuota. Cuando se agota, esperas a que se renueve el período.
La primera línea del runtime/ROTEAMENTO.md resume el módulo: "No uses siempre el modelo más potente. Cada llamada consume la cuota de tu suscripción."
🆕 ¿Eres nuevo aquí? Tres palabras de este módulo
- Cuota — el límite de uso de tu suscripción durante un período. No es dinero: es cuánto puedes pedir antes de tener que esperar.
- Modelo — la «cabeza» de la IA que responde. Claude Code tiene varias (
opus,sonnet,haiku…), Codex también. Los más potentes piensan mejor y consumen más cuota. - Equivalente de API — cuánto costaría la misma tarea si se cobrara por uso de la API. Sirve como referencia para comparar, aunque no pagues eso.
Cómo leer el diagrama: la barra morada es la cuota. Los bloques azules cortos son solicitudes al modelo más pequeño; los rojos largos son el modelo más potente usado sin necesidad. Dos llamadas innecesarias al modelo superior consumen más que varias tareas bien hechas. Los tamaños son ilustrativos, no son medidas.
✓ Cuota (lo que tienes)
- ✓ Viene con la suscripción que ya pagas
- ✓ Termina, pero vuelve en el período siguiente
- ✓ Rinde más cuando cada tarea usa el modelo adecuado
- ✓ Es lo que usa todo el kit
✗ Dólares de API (que no necesitas)
- ✗ Cuenta separada, cobrada por uso
- ✗ No se recupera: lo que gastaste, ya lo pagaste
- ✗ Ninguna receta del kit depende de ella
- ✗ En el curso aparece solo como referencia para comparar
💡 Un número real para tener una idea
El CHANGELOG del kit registra que el equipo de tres roles (módulo 3.2), al crear un archivo de una frase, gastó el equivalente a ~US$ 0,73 de API. En la suscripción, esto es cuota, no un cobro. Pero demuestra que incluso una tarea diminuta tiene un costo cuando llama a modelos grandes.
plan mensual
límite por período
referencia, no factura
modelo por tarea
Lee los cuatro niveles de modelo
El kit no habla de nombres de modelos sueltos. Habla de nivel del modelo: súper, principal, ejecutor y menor. Cada nivel indica cuando usar e indicar el modelo en Claude Code, en Codex y en tu computadora.
Esta es la tabla de runtime/ROTEAMENTO.md, copiada del kit:
| Nivel | Cuándo | Claude Code | Codex | Local (gratis, Ollama) |
|---|---|---|---|---|
| super | poco frecuente: problema difícil, decisión importante | fable · esfuerzo alto | gpt-6-astra · high | — |
| máximo | planificar, decidir, revisar lo difícil | opus · medio | gpt-6-astra · medium | qwen3.8:27b |
| ejecutor | hacer el trabajo del día a día | opus · bajo / sonnet | gpt-6-sol · low | qwen3.8:27b |
| menor | triaje, formato, verificación | haiku / sonnet | gpt-6-luna | llama3.2 |
Qué revisar en la tabla: la columna «Cuándo» es la que usas en el día a día. Las tres de la derecha solo indican qué nombre escribir en cada herramienta. Fíjate que gpt-6-luna, el patrón del puente del módulo 2.1, es el nivel menor.
🆕 ¿Eres nuevo aquí? «Esfuerzo» y «Local»
Esfuerzo es cuánto piensa el modelo antes de responder (bajo, medio, alto). El mismo modelo con un nivel de esfuerzo alto piensa más y consume más cuota. Local es un modelo que se ejecuta en tu propia computadora mediante Ollama: no consume cuota, pero depende de que tu máquina pueda ejecutarlo. El doctor muestra si tienes Ollama (línea ollama, marcada como opcional).
Cómo leer el diagrama: el ancho del peldaño indica cuánto debería aparecer en tu día a día. El más pequeño (morado, con brillo) es la base amplia. El super, rojo y estrecho, es una excepción: si aparece todo el tiempo, algo está mal en el enrutamiento.
decisión importante
planificar y revisar
hacer
hacer triaje y verificar
Empieza por lo mínimo que resuelva el problema
Regla 1 del enrutamiento: "Empieza con el mínimo que resuelve; sube solo si falla." O AGENTS.md del kit repite esto para los dos agentes: "usa el modelo más pequeño que resuelva la tarea".
En la práctica, subes un nivel a la vez y solo si hay un motivo: el nivel más bajo se equivocó, dejó pasar algo o no pudo con el tamaño.
Lo mínimo: dar formato y verificar
Clara quiere la lista de horarios disponibles en formato de mensaje. Eso es dar formato: un nivel menor.
¿Te equivocaste? Executor
Sônia pide el total por cliente del CSV del ERP. Si el más pequeño suma mal, se lo pasa al ejecutor. Ella verifica a mano que la cuenta sea correcta (módulo 2.3).
¿Decisión? Inicio
"¿Cómo conecto el ERP sin API al agente?" es planificar y decidir. Ahí el nivel superior se justifica.
Muy bien: solo si el nivel superior se atasca
Problema realmente difícil, decisión importante. Poco frecuente, como dice la tabla.
El puente de Codex ya viene así: sin que tengas que decir nada, usa gpt-6-luna, el nivel menor. Para subir, cambias la variable CODEX_MODELO solo en esa llamada.
En la terminal, dentro de la carpeta del kit (puente del módulo 2.1, ya con chmod +x):
runtime/pontes/codex-exec.sh "Responda apenas PONG"
Resultado comprobado en CHANGELOG 0.1.0:
PONG
Para subir al nivel ejecutor de Codex solo en esta llamada, pon la variable al principio:
CODEX_MODELO=gpt-6-sol runtime/pontes/codex-exec.sh "Responda apenas PONG"
PONG usando el estándar gpt-6-luna. La variable solo tiene efecto en la línea donde aparece; en la siguiente llamada se vuelve al nivel menor.💡 Sube con un motivo por escrito
Cuando subas de nivel, anota por qué en una línea ("el menor sumó mal el total de Padaria Lua"). Después de algunas semanas, esas líneas muestran qué tareas merecen nacer en un nivel superior.
regla 1
un nivel a la vez
patrón del puente
cambia mediante una llamada
Pídele una revisión a otro modelo
Regla 3: "La revisión por otro modelo (p. ej., Claude lo hace y Codex lo revisa — receta R1) detecta errores que el mismo modelo no ve."
Es la misma lógica que pedirle a un colega que vuelva a leer tu texto. Quien lo escribió tiende a leer lo que quiso escribir, no lo que está ahí. Un modelo de otra empresa tiene otros puntos ciegos.
Cómo leer el diagrama: la flecha azul es el puente del módulo 2.1 que lleva la solicitud a Codex. La curva violeta discontinua es la revisión que vuelve. Codex solo lee: quien decide qué se queda es Claude y, al final, tú.
Abre claude en la carpeta del kit y pega (prompt de la receta R1):
Usa runtime/pontes/codex-exec.sh para pedirle a Codex que revise el archivo README.md: ¿qué resulta confuso para alguien que empieza? Después, compara con tu opinión.
✓ Revisión por otro modelo
- ✓ Los distintos puntos ciegos se compensan
- ✓ El revisor puede ser de un nivel inferior
- ✓ El desacuerdo se convierte en una pregunta para ti
- ✓ Ya viene lista en el puente del kit
✗ El mismo modelo revisándose a sí mismo
- ✗ Tiende a estar de acuerdo con lo que acaba de hacer
- ✗ Repite el mismo error de lectura
- ✗ Da una falsa sensación de "verificado"
- ✗ Gasta cuota sin aportar una mirada nueva
regla 3
Claude ejecuta, Codex revisa
patrón del puente
en los desacuerdos
Forma un equipo solo cuando valga la pena
Regla 2: "Un equipo de agentes solo cuando el trabajo supera el costo de armar el equipo." Un equipo (módulo 3.2) llama a varios modelos, y cada uno lee la tarea y el proyecto desde cero.
El ejemplo del propio kit muestra el costo: el equipo creó un archivo de una frase y gastó el equivalente a ~US$ 0,73 de API. Fue una excelente prueba. Para escribir una frase en el día a día, bastaría un solo agente.
| Tarea | ¿Basta con un agente? | ¿Conviene usar un equipo? |
|---|---|---|
| Organizar los horarios libres de Clara | Sí, nivel menor | No |
| Responder una duda sobre la POLITICA | Sí | No |
| Resumen mensual del ERP de Sônia, con totales verificados | Arriesgado: nadie comprueba | Sí: planificar, hacer y verificar |
| Crear el puente del sistema de un cliente | Arriesgado | Sí |
Qué revisar en la tabla: el equipo compensa cuando equivocarse sale caro y alguien debe revisar. Si la tarea cabe en una frase y el error se ve de inmediato, un solo agente basta.
⚠️ Un agente dentro de otro agente pesa más de lo que parece
Regla 4, copiada del kit: "Una llamada de agente dentro de otro agente carga las instrucciones y herramientas del proyecto. Para puentes sencillos, usa una carpeta ligera o el modo --bare de Claude." Es decir: cada llamada interna vuelve a leer las reglas de la carpeta. En una carpeta llena, eso multiplica el gasto.
💡 Pregunta rápida
Antes de formar un equipo, pregúntate: "si el agente se equivoca en esto, ¿me doy cuenta de inmediato?". Si te das cuenta, usa un solo agente. Si no, el revisor del equipo vale la cuota.
tarea corta
trabajo mayor que el costo
menos para volver a leer
equivalente de la R2
Mantén la tabla actualizada
La última línea de ROTEAMENTO.md avisa: "Los nombres de los modelos cambian. Comprueba con claude --help e codex --help y actualiza esta tabla."
Los niveles se quedan. Lo que cambia es el nombre dentro de cada celda. Por eso las recetas hablan de "nivel inferior" y no de un nombre fijo.
En la terminal, un comando a la vez:
claude --help codex --help
O deja que el agente compare. Abre claude en la carpeta del kit y pega:
Rode claude --help e codex --help, compare com a tabela de runtime/ROTEAMENTO.md e me diga quais nomes de modelo mudaram. Não edite o arquivo: proponha a mudança numa linha da tabela Aprendizado da runtime/POLITICA.md.
ROTEAMENTO.md sigue igual hasta que lo apruebes.Cómo leer el diagrama: la caja morada con brillo eres tú. El agente revisa y propone, pero no modifica por su cuenta el archivo de reglas. Es el «propone → aprueba → incorpora» de la POLITICA.md, que ves a fondo en el módulo 4.2.
Prueba rápida (opcional): Sônia solo quiere organizar en una tabla el total por cliente que ya verificó. ¿Qué nivel usar?
fuente del nombre actual
el nombre cambia
el agente propone
y solo entonces cambia
🎓 Resumen del módulo
CODEX_MODELO solo si se equivoca.--help.Próximo módulo:
3.2 — Equipo de tres roles