Entenda por que cota não é dólar
O kit roda pela assinatura do Claude Code e do Codex. Você paga o plano do mês e ponto. Não chega fatura por chamada.
Mas a assinatura tem um limite de uso por período: a cota. Cada pedido ao agente gasta um pedaço dela. Quando acaba, você espera o período virar.
A primeira linha do runtime/ROTEAMENTO.md resume o módulo: "Não use sempre o modelo mais forte. Cada chamada consome a cota da sua assinatura."
🆕 Novo aqui? Três palavras deste módulo
- Cota — o limite de uso da sua assinatura num período. Não é dinheiro: é quanto você ainda pode pedir antes de ter de esperar.
- Modelo — a "cabeça" da IA que responde. O Claude Code tem vários (
opus,sonnet,haiku…), o Codex também. Os mais fortes pensam melhor e gastam mais cota. - Equivalente de API — quanto a mesma tarefa custaria se fosse cobrada por uso na API. Serve de régua para comparar, mesmo que você não pague isso.
Como ler o desenho: a barra roxa é a cota. Os blocos azuis curtos são pedidos ao modelo menor; os vermelhos longos são o modelo mais forte usado sem necessidade. Duas chamadas desnecessárias ao topo comem mais que várias tarefas certas. Os tamanhos são ilustrativos, não medidas.
✓ Cota (o que você tem)
- ✓ Vem com a assinatura que você já paga
- ✓ Acaba, mas volta no período seguinte
- ✓ Rende mais quando cada tarefa usa o modelo certo
- ✓ É o que o kit inteiro usa
✗ Dólar de API (o que você não precisa)
- ✗ Conta separada, cobrada por uso
- ✗ Não volta: o que gastou, pagou
- ✗ Nenhuma receita do kit depende dela
- ✗ No curso aparece só como régua de comparação
💡 Um número real para ter noção
O CHANGELOG do kit registra que o time de três papéis (módulo 3.2), criando um arquivo de uma frase, gastou o equivalente a ~US$ 0,73 de API. Na assinatura isso é cota, não cobrança. Mas mostra que até uma tarefa minúscula tem peso quando chama modelos grandes.
plano mensal
limite por período
régua, não fatura
modelo por tarefa
Leia os quatro níveis de modelo
O kit não fala em nomes de modelo soltos. Fala em nível de modelo: super, topo, executor e menor. Cada nível diz quando usar e aponta o modelo no Claude Code, no Codex e no seu computador.
Esta é a tabela do runtime/ROTEAMENTO.md, copiada do kit:
| Nível | Quando | Claude Code | Codex | Local (grátis, Ollama) |
|---|---|---|---|---|
| super | raro: problema difícil, decisão grande | fable · esforço alto | gpt-6-astra · high | — |
| topo | planejar, decidir, revisar o difícil | opus · médio | gpt-6-astra · medium | qwen3.8:27b |
| executor | fazer o trabalho do dia a dia | opus · baixo / sonnet | gpt-6-sol · low | qwen3.8:27b |
| menor | triagem, formatar, checar | haiku / sonnet | gpt-6-luna | llama3.2 |
O que olhar na tabela: a coluna "Quando" é a que você usa no dia a dia. As três da direita só dizem qual nome digitar em cada ferramenta. Note que gpt-6-luna, o padrão da ponte do módulo 2.1, é o nível menor.
🆕 Novo aqui? "Esforço" e "Local"
Esforço é quanto o modelo pensa antes de responder (baixo, médio, alto). O mesmo modelo com esforço alto pensa mais e gasta mais cota. Local é um modelo que roda no seu próprio computador pelo Ollama: não gasta cota nenhuma, mas depende da sua máquina aguentar. O doctor mostra se você tem Ollama (linha ollama, marcada como opcional).
Como ler o desenho: a largura do degrau é quanto ele deve aparecer no seu dia. O menor (roxo, com brilho) é a base larga. O super, vermelho e estreito, é exceção: se ele aparece toda hora, algo está errado no roteamento.
decisão grande
planejar e revisar
fazer
triar e checar
Comece pelo menor que resolve
Regra 1 do roteamento: "Comece no menor que resolve; suba só se errar." O AGENTS.md do kit repete isso para os dois agentes: "use o menor modelo que resolve".
Na prática, você sobe um degrau por vez, e só com motivo: o menor errou, deixou passar algo ou não deu conta do tamanho.
Menor: formatar e checar
Clara quer a lista de horários livres em formato de mensagem. Isso é formatar: nível menor.
Errou? Executor
Sônia pede o total por cliente do CSV do ERP. Se o menor somar errado, sobe para o executor. A conta certa ela confere à mão (módulo 2.3).
Decisão? Topo
"Como ligo o ERP sem API ao agente?" é planejar e decidir. Aí o topo se paga.
Super: só se o topo travar
Problema difícil de verdade, decisão grande. Raro, como diz a tabela.
A ponte do Codex já nasce assim: sem você dizer nada, ela usa gpt-6-luna, o nível menor. Para subir, você troca a variável CODEX_MODELO só naquela chamada.
No terminal, dentro da pasta do kit (ponte do módulo 2.1, já com chmod +x):
runtime/pontes/codex-exec.sh "Responda apenas PONG"
Resultado provado no CHANGELOG 0.1.0:
PONG
Para subir ao nível executor do Codex só nesta chamada, ponha a variável na frente:
CODEX_MODELO=gpt-6-sol runtime/pontes/codex-exec.sh "Responda apenas PONG"
PONG usando o padrão gpt-6-luna. A variável vale só para a linha em que aparece; a próxima chamada volta ao menor.💡 Suba com motivo escrito
Quando subir de nível, anote por quê numa linha ("menor somou errado o total da Padaria Lua"). Depois de algumas semanas, essas linhas mostram quais tarefas merecem nascer num nível acima.
regra 1
um degrau por vez
padrão da ponte
troca por chamada
Peça revisão a outro modelo
Regra 3: "Revisão por outro modelo (ex.: Claude faz, Codex revisa — receita R1) pega erros que o mesmo modelo não vê."
É a mesma lógica de pedir a um colega para reler o seu texto. Quem escreveu tende a ler o que quis escrever, não o que está lá. Um modelo de outra empresa tem outros pontos cegos.
Como ler o desenho: a seta azul é a ponte do módulo 2.1 levando o pedido ao Codex. A curva roxa tracejada é a revisão voltando. O Codex só lê: quem decide o que fica é o Claude, e no fim você.
Abra claude na pasta do kit e cole (prompt da receita R1):
Use runtime/pontes/codex-exec.sh para pedir ao Codex uma revisão do arquivo README.md: o que está confuso para um iniciante? Depois compare com a sua opinião.
✓ Revisão por outro modelo
- ✓ Pontos cegos diferentes se cancelam
- ✓ O revisor pode ser de nível menor
- ✓ Discordância vira pergunta para você
- ✓ Já vem pronta na ponte do kit
✗ O mesmo modelo revisando a si
- ✗ Tende a concordar com o que acabou de fazer
- ✗ Repete o mesmo erro de leitura
- ✗ Dá falsa sensação de "conferido"
- ✗ Gasta cota sem acrescentar olhar novo
regra 3
Claude faz, Codex revisa
padrão da ponte
nas discordâncias
Monte time só quando compensa
Regra 2: "Time de agentes só quando o trabalho é maior que o custo de montar o time." Um time (módulo 3.2) chama vários modelos, e cada um lê a tarefa e o projeto do zero.
O exemplo do próprio kit mostra o peso: o time criou um arquivo de uma frase e gastou o equivalente a ~US$ 0,73 de API. Foi ótimo como teste. Para escrever uma frase no dia a dia, um agente só bastaria.
| Tarefa | Um agente basta? | Time compensa? |
|---|---|---|
| Formatar os horários livres da Clara | Sim, nível menor | Não |
| Responder uma dúvida sobre a POLITICA | Sim | Não |
| Resumo mensal do ERP da Sônia, com totais conferidos | Arriscado: ninguém confere | Sim: planejar, fazer e conferir |
| Montar a ponte do sistema de um cliente | Arriscado | Sim |
O que olhar na tabela: o time compensa quando errar sai caro e alguém precisa conferir. Se a tarefa cabe numa frase e o erro é visível na hora, um agente só resolve.
⚠️ Agente dentro de agente pesa mais do que parece
Regra 4, copiada do kit: "Chamada de agente dentro de agente carrega as instruções e ferramentas do projeto. Para pontes simples, use uma pasta enxuta ou o modo --bare do Claude." Ou seja: cada chamada interna relê as regras da pasta. Numa pasta cheia, isso multiplica o gasto.
💡 Pergunta de bolso
Antes de montar time, pergunte: "se o agente errar isso, eu percebo na hora?". Se percebe, vá de um agente só. Se não percebe, o revisor do time vale a cota.
tarefa curta
trabalho maior que o custo
menos para reler
equivalente da R2
Mantenha a tabela atualizada
A última linha do ROTEAMENTO.md avisa: "Os nomes dos modelos mudam. Confira com claude --help e codex --help e atualize esta tabela."
Os níveis ficam. O que muda é o nome dentro de cada célula. Por isso as receitas falam em "nível menor", e não num nome fixo.
No terminal, um comando por vez:
claude --help codex --help
Ou deixe o agente comparar. Abra claude na pasta do kit e cole:
Rode claude --help e codex --help, compare com a tabela de runtime/ROTEAMENTO.md e me diga quais nomes de modelo mudaram. Não edite o arquivo: proponha a mudança numa linha da tabela Aprendizado da runtime/POLITICA.md.
ROTEAMENTO.md continua igual até você aprovar.Como ler o desenho: a caixa roxa com brilho é você. O agente confere e propõe, mas não mexe sozinho no arquivo de regras. É o "propõe → aprova → incorpora" da POLITICA.md, que você vê a fundo no módulo 4.2.
Teste rápido (opcional): a Sônia quer só formatar em tabela o total por cliente que já conferiu. Que nível usar?
fonte do nome atual
nome muda
agente propõe
e só então muda
🎓 Resumo do módulo
CODEX_MODELO só se errar.--help.Próximo módulo:
3.2 — Time de três papéis