PTENES
Pular para o conteúdo
MÓDULO 3.1

🎚️ Modelo certo, cota rende

Usar sempre o modelo mais forte é como mandar o diretor da empresa conferir carimbo. Funciona, mas acaba com a cota. O ROTEAMENTO.md do kit diz qual modelo chamar para cada tipo de tarefa.

6
Tópicos
~35
Minutos
Base
Nível
Fundamento
Tipo
0 de 60%
1

Entenda por que cota não é dólar

O kit roda pela assinatura do Claude Code e do Codex. Você paga o plano do mês e ponto. Não chega fatura por chamada.

Mas a assinatura tem um limite de uso por período: a cota. Cada pedido ao agente gasta um pedaço dela. Quando acaba, você espera o período virar.

A primeira linha do runtime/ROTEAMENTO.md resume o módulo: "Não use sempre o modelo mais forte. Cada chamada consome a cota da sua assinatura."

🆕 Novo aqui? Três palavras deste módulo

  • Cota — o limite de uso da sua assinatura num período. Não é dinheiro: é quanto você ainda pode pedir antes de ter de esperar.
  • Modelo — a "cabeça" da IA que responde. O Claude Code tem vários (opus, sonnet, haiku…), o Codex também. Os mais fortes pensam melhor e gastam mais cota.
  • Equivalente de API — quanto a mesma tarefa custaria se fosse cobrada por uso na API. Serve de régua para comparar, mesmo que você não pague isso.
Cota do período (a sua assinatura) m m executor m super para uma tarefa simples super de novo… m = modelo menor: bloco curto · executor: bloco médio · super: bloco longo cota acabou: espere o período virar

Como ler o desenho: a barra roxa é a cota. Os blocos azuis curtos são pedidos ao modelo menor; os vermelhos longos são o modelo mais forte usado sem necessidade. Duas chamadas desnecessárias ao topo comem mais que várias tarefas certas. Os tamanhos são ilustrativos, não medidas.

✓ Cota (o que você tem)

  • ✓ Vem com a assinatura que você já paga
  • ✓ Acaba, mas volta no período seguinte
  • ✓ Rende mais quando cada tarefa usa o modelo certo
  • ✓ É o que o kit inteiro usa

✗ Dólar de API (o que você não precisa)

  • ✗ Conta separada, cobrada por uso
  • ✗ Não volta: o que gastou, pagou
  • ✗ Nenhuma receita do kit depende dela
  • ✗ No curso aparece só como régua de comparação

💡 Um número real para ter noção

O CHANGELOG do kit registra que o time de três papéis (módulo 3.2), criando um arquivo de uma frase, gastou o equivalente a ~US$ 0,73 de API. Na assinatura isso é cota, não cobrança. Mas mostra que até uma tarefa minúscula tem peso quando chama modelos grandes.

💳
Assinatura

plano mensal

⏳
Cota

limite por período

📏
Equivalente

régua, não fatura

🎚️
Roteamento

modelo por tarefa

2

Leia os quatro níveis de modelo

O kit não fala em nomes de modelo soltos. Fala em nível de modelo: super, topo, executor e menor. Cada nível diz quando usar e aponta o modelo no Claude Code, no Codex e no seu computador.

Esta é a tabela do runtime/ROTEAMENTO.md, copiada do kit:

NívelQuandoClaude CodeCodexLocal (grátis, Ollama)
superraro: problema difícil, decisão grandefable · esforço altogpt-6-astra · high—
topoplanejar, decidir, revisar o difícilopus · médiogpt-6-astra · mediumqwen3.8:27b
executorfazer o trabalho do dia a diaopus · baixo / sonnetgpt-6-sol · lowqwen3.8:27b
menortriagem, formatar, checarhaiku / sonnetgpt-6-lunallama3.2

O que olhar na tabela: a coluna "Quando" é a que você usa no dia a dia. As três da direita só dizem qual nome digitar em cada ferramenta. Note que gpt-6-luna, o padrão da ponte do módulo 2.1, é o nível menor.

🆕 Novo aqui? "Esforço" e "Local"

Esforço é quanto o modelo pensa antes de responder (baixo, médio, alto). O mesmo modelo com esforço alto pensa mais e gasta mais cota. Local é um modelo que roda no seu próprio computador pelo Ollama: não gasta cota nenhuma, mas depende da sua máquina aguentar. O doctor mostra se você tem Ollama (linha ollama, marcada como opcional).

superraro topoplanejar, decidir, revisar o difícil executoro trabalho do dia a dia menortriagem, formatar, checar — comece aqui mais cota por chamada ↑ mais usado ↓

Como ler o desenho: a largura do degrau é quanto ele deve aparecer no seu dia. O menor (roxo, com brilho) é a base larga. O super, vermelho e estreito, é exceção: se ele aparece toda hora, algo está errado no roteamento.

🔺
super

decisão grande

🧠
topo

planejar e revisar

🛠️
executor

fazer

🔎
menor

triar e checar

3

Comece pelo menor que resolve

Regra 1 do roteamento: "Comece no menor que resolve; suba só se errar." O AGENTS.md do kit repete isso para os dois agentes: "use o menor modelo que resolve".

Na prática, você sobe um degrau por vez, e só com motivo: o menor errou, deixou passar algo ou não deu conta do tamanho.

1

Menor: formatar e checar

Clara quer a lista de horários livres em formato de mensagem. Isso é formatar: nível menor.

2

Errou? Executor

Sônia pede o total por cliente do CSV do ERP. Se o menor somar errado, sobe para o executor. A conta certa ela confere à mão (módulo 2.3).

3

Decisão? Topo

"Como ligo o ERP sem API ao agente?" é planejar e decidir. Aí o topo se paga.

4

Super: só se o topo travar

Problema difícil de verdade, decisão grande. Raro, como diz a tabela.

A ponte do Codex já nasce assim: sem você dizer nada, ela usa gpt-6-luna, o nível menor. Para subir, você troca a variável CODEX_MODELO só naquela chamada.

🎯 Objetivo: chamar o Codex no nível menor e saber como subir um degrau

No terminal, dentro da pasta do kit (ponte do módulo 2.1, já com chmod +x):

runtime/pontes/codex-exec.sh "Responda apenas PONG"

Resultado provado no CHANGELOG 0.1.0:

PONG

Para subir ao nível executor do Codex só nesta chamada, ponha a variável na frente:

CODEX_MODELO=gpt-6-sol runtime/pontes/codex-exec.sh "Responda apenas PONG"
Como verificar: a primeira chamada devolve PONG usando o padrão gpt-6-luna. A variável vale só para a linha em que aparece; a próxima chamada volta ao menor.

💡 Suba com motivo escrito

Quando subir de nível, anote por quê numa linha ("menor somou errado o total da Padaria Lua"). Depois de algumas semanas, essas linhas mostram quais tarefas merecem nascer num nível acima.

⬇️
Comece embaixo

regra 1

⬆️
Suba se errar

um degrau por vez

🌙
gpt-6-luna

padrão da ponte

🔧
CODEX_MODELO

troca por chamada

4

Peça revisão a outro modelo

Regra 3: "Revisão por outro modelo (ex.: Claude faz, Codex revisa — receita R1) pega erros que o mesmo modelo não vê."

É a mesma lógica de pedir a um colega para reler o seu texto. Quem escreveu tende a ler o que quis escrever, não o que está lá. Um modelo de outra empresa tem outros pontos cegos.

Claude faz o trabalho codex-exec.sh Codex revisa só leitura (N4) a revisão volta você recebe as duas opiniões

Como ler o desenho: a seta azul é a ponte do módulo 2.1 levando o pedido ao Codex. A curva roxa tracejada é a revisão voltando. O Codex só lê: quem decide o que fica é o Claude, e no fim você.

🎯 Objetivo: segunda opinião de outro modelo sem sair do Claude

Abra claude na pasta do kit e cole (prompt da receita R1):

Use runtime/pontes/codex-exec.sh para pedir ao Codex uma revisão do arquivo README.md: o que está confuso para um iniciante? Depois compare com a sua opinião.
Como verificar: o Claude pede para rodar a ponte, mostra o que o Codex respondeu e depois separa onde os dois concordam e onde discordam.

✓ Revisão por outro modelo

  • ✓ Pontos cegos diferentes se cancelam
  • ✓ O revisor pode ser de nível menor
  • ✓ Discordância vira pergunta para você
  • ✓ Já vem pronta na ponte do kit

✗ O mesmo modelo revisando a si

  • ✗ Tende a concordar com o que acabou de fazer
  • ✗ Repete o mesmo erro de leitura
  • ✗ Dá falsa sensação de "conferido"
  • ✗ Gasta cota sem acrescentar olhar novo
👀
Outro olhar

regra 3

🤝
Receita R1

Claude faz, Codex revisa

📖
Só leitura

padrão da ponte

⚖️
Você decide

nas discordâncias

5

Monte time só quando compensa

Regra 2: "Time de agentes só quando o trabalho é maior que o custo de montar o time." Um time (módulo 3.2) chama vários modelos, e cada um lê a tarefa e o projeto do zero.

O exemplo do próprio kit mostra o peso: o time criou um arquivo de uma frase e gastou o equivalente a ~US$ 0,73 de API. Foi ótimo como teste. Para escrever uma frase no dia a dia, um agente só bastaria.

TarefaUm agente basta?Time compensa?
Formatar os horários livres da ClaraSim, nível menorNão
Responder uma dúvida sobre a POLITICASimNão
Resumo mensal do ERP da Sônia, com totais conferidosArriscado: ninguém confereSim: planejar, fazer e conferir
Montar a ponte do sistema de um clienteArriscadoSim

O que olhar na tabela: o time compensa quando errar sai caro e alguém precisa conferir. Se a tarefa cabe numa frase e o erro é visível na hora, um agente só resolve.

⚠️ Agente dentro de agente pesa mais do que parece

Regra 4, copiada do kit: "Chamada de agente dentro de agente carrega as instruções e ferramentas do projeto. Para pontes simples, use uma pasta enxuta ou o modo --bare do Claude." Ou seja: cada chamada interna relê as regras da pasta. Numa pasta cheia, isso multiplica o gasto.

💡 Pergunta de bolso

Antes de montar time, pergunte: "se o agente errar isso, eu percebo na hora?". Se percebe, vá de um agente só. Se não percebe, o revisor do time vale a cota.

👤
Um agente

tarefa curta

👥
Time

trabalho maior que o custo

📦
Pasta enxuta

menos para reler

💸
~US$ 0,73

equivalente da R2

6

Mantenha a tabela atualizada

A última linha do ROTEAMENTO.md avisa: "Os nomes dos modelos mudam. Confira com claude --help e codex --help e atualize esta tabela."

Os níveis ficam. O que muda é o nome dentro de cada célula. Por isso as receitas falam em "nível menor", e não num nome fixo.

🎯 Objetivo: ver quais modelos as suas ferramentas aceitam hoje

No terminal, um comando por vez:

claude --help
codex --help

Ou deixe o agente comparar. Abra claude na pasta do kit e cole:

Rode claude --help e codex --help, compare com a tabela de runtime/ROTEAMENTO.md e me diga quais nomes de modelo mudaram. Não edite o arquivo: proponha a mudança numa linha da tabela Aprendizado da runtime/POLITICA.md.
Como verificar: na ajuda, procure a opção de modelo (a que escolhe o modelo da chamada). Se o agente propôs algo, a linha aparece na tabela Aprendizado com status "proposto", e o ROTEAMENTO.md continua igual até você aprovar.
1 · conferir--help das duas CLIs 2 · proporlinha no Aprendizado 3 · você aprovasim ou não 4 · atualizarROTEAMENTO.md os quatro níveis não mudam; só o nome dentro de cada célula

Como ler o desenho: a caixa roxa com brilho é você. O agente confere e propõe, mas não mexe sozinho no arquivo de regras. É o "propõe → aprova → incorpora" da POLITICA.md, que você vê a fundo no módulo 4.2.

Teste rápido (opcional): a Sônia quer só formatar em tabela o total por cliente que já conferiu. Que nível usar?

❓
--help

fonte do nome atual

🏷️
Nível fixo

nome muda

📝
Aprendizado

agente propõe

✅
Você aprova

e só então muda

🎓 Resumo do módulo

✓
Cota não é dólar — é o limite da assinatura, e cada chamada gasta um pedaço.
✓
Quatro níveis — super, topo, executor e menor, com o nome em cada ferramenta.
✓
Comece pelo menor — e suba com CODEX_MODELO só se errar.
✓
Revisão por outro modelo — Claude faz, Codex revisa.
✓
Time só quando compensa — e a tabela se confere com --help.

Próximo módulo:

3.2 — Time de três papéis