Mapa da trilha
Conteúdo detalhado
🎚️ Modelo certo, cota rende
O ROTEAMENTO.md: quatro níveis de modelo no Claude Code, no Codex e no Ollama, e quatro regras para gastar menos cota sem perder qualidade.
Cada chamada consome a cota da sua assinatura, o limite de uso por período. Não é cobrança por uso, como na API.
Usar sempre o modelo mais forte esgota a cota antes da hora e trava o trabalho do dia.
Cota, assinatura, API, consumo por chamada.
A tabela do ROTEAMENTO.md: quando usar cada nível e qual modelo corresponde a ele no Claude Code, no Codex e no Ollama (local, grátis).
Com a tabela à mão, você escolhe o modelo pela tarefa, e não pelo hábito.
Nível de modelo, esforço, modelo local, Ollama.
A regra 1: triagem, formatação e checagem vão no menor modelo; você sobe de nível só quando ele erra.
A maior parte das tarefas do dia a dia cabe nos níveis de baixo, e a cota sobra para o que é difícil.
Menor que resolve, subir de nível, triagem.
A regra 3: a revisão feita por outro modelo, como o Codex pela ponte da receita R1, pega erros que o mesmo modelo não vê.
Um modelo tende a concordar consigo mesmo; um segundo olhar quebra esse ponto cego.
Segunda opinião, ponte codex-exec, ponto cego.
As regras 2 e 4: time de agentes só quando o trabalho supera o custo de montar o time, e agente dentro de agente carrega as instruções do projeto.
Time em tarefa pequena só multiplica o consumo; pasta enxuta ou o modo --bare deixam pontes simples mais leves.
Custo de montar o time, pasta enxuta, --bare.
Conferir os nomes dos modelos com claude --help e codex --help e atualizar a tabela do ROTEAMENTO.md.
Modelos são renomeados e substituídos; tabela velha manda o agente pedir um modelo que não existe mais.
--help, nome de modelo, tabela viva.
👥 Time de três papéis
A receita R2: planejador, executor e revisor, cada um com o modelo que precisa, rodando numa sessão só do Claude Code.
Três subagentes do Claude Code: o planejador (forte) planeja, o executor (médio) faz e o revisor (leve) confere.
Cada papel usa o modelo que precisa, e a cota rende mais do que com um modelo forte fazendo tudo.
Subagente, papel, planejador, executor, revisor.
Os três arquivos em .claude/agents/, com nome, descrição, modelo, ferramentas e instruções de cada papel.
Lendo os arquivos você entende o que cada papel pode fazer: planejador e revisor só leem, o executor altera (N3).
Arquivo de papel, model:, ferramentas, N3.
Abrir o claude na pasta e pedir ao time que crie saudacao.txt com a frase "Olá, comunidade INEMA".
É o jeito mais fácil de ver os três papéis trabalhando em sequência, com o revisor fechando em APROVADO.
Sessão interativa, prova, APROVADO.
O mesmo pedido num comando só, com claude -p, terminando com a resposta do revisor.
Sem tela, o time pode ser chamado por script; a prova do kit custou o equivalente a ~US$ 0,73 de API, que na assinatura é cota.
-p, execução sem tela, cat saudacao.txt, cota.
Trocar a tarefa: a Sônia resume o CSV do ERP com o revisor conferindo os totais; a Clara lista horários livres e o revisor confere que nenhum ocupado apareceu.
O time só vale a pena quando resolve o seu trabalho real, com uma conferência que você entende.
Tarefa real, conferência, totais, horário ocupado.
Editar a linha model: de um papel (haiku, sonnet, opus ou inherit) e copiar um arquivo de .claude/agents/ para criar um papel novo.
O time se ajusta ao seu caso sem programar: é só editar texto.
model:, inherit, papel novo, descrição.
🧵 Time em segundo plano
A receita R4: várias sessões com claude --bg, cada uma com nome, modo e modelo, acompanhadas pelo observar.mjs.
A versão oficial do que vídeos de mods chamavam de "Threads": sessões que trabalham sozinhas, em segundo plano.
É comando documentado: não quebra na próxima atualização como o fio improvisado dos vídeos.
Sessão, segundo plano, id, via oficial.
Abrir o claude na pasta uma vez e trocar a opção "No, exit" por "Yes, I trust this folder".
Sem isso, o --bg responde Workspace not trusted e nenhuma sessão nasce.
Pasta confiável, aviso de confiança, Workspace not trusted.
Duas linhas de comando: um revisor em modo plano, que só lê, e um executor no sonnet, que cria resumo.md.
Nome, modo e modelo por sessão aplicam a POLITICA e o ROTEAMENTO; e -p junto com --bg o Claude recusa.
--bg, --permission-mode plan, --model, --name.
O observar.mjs mostra id, tipo, nome, estado e idade de cada sessão desta pasta (ou de todas, com --todas).
Em segundo plano ninguém vê uma sessão travar; a coluna estado mostra working, idle, done, blocked ou failed.
observar.mjs, estado, blocked, --todas.
Três comandos com o id da tabela: claude logs lê a tela, claude attach entra na sessão e claude stop para.
Você destrava um blocked, lê a resposta de um done e corta uma sessão que só gasta cota.
logs, attach, stop, /painel.
Cada sessão grava em arquivo e uma sessão chefe (ou o time da R2) consolida e confere no fim.
Cada sessão consome cota: comece pela R2 e só solte sessões paralelas quando o trabalho compensar.
Arquivo por sessão, sessão chefe, consolidar, cota.
🎯 Agente longo com verificação
A receita R6: um goal com critérios comando → saída, o verificar.mjs como juiz e portões humanos escritos no próprio goal.
Em tarefas de horas, o agente perde detalhes e declara "pronto" cedo; a R6 só aceita o fim quando os critérios provam.
O erro descoberto só no uso custa mais que uma checagem automática a cada etapa.
Goal, critério, saída 0 e 1, portão humano.
Uma linha de lista por critério, com o comando e o texto esperado entre crases, separados por uma seta.
Bom critério é sim ou não e impossível de passar sem o trabalho; "deixar bom" não é critério.
Critério verificável, texto esperado, goal de exemplo.
Rodar o verificar.mjs no goal de exemplo, que confere a ponte da agenda da Clara, o total da Sônia e o doctor.
O script não chama modelo nem gasta cota: você testa o juiz antes de entregar o goal ao agente.
verificar.mjs, OK, contagem, saída 0.
Mudar um valor esperado numa cópia do goal e ver a linha virar FALHA, com saída 1, como provado no CHANGELOG 0.2.0.
Um juiz que nunca reprova não serve; você confirma que ele pega o erro.
Cópia do goal, FALHA, esperado, saída 1.
O pedido /goal da R6: cumprir o goal, rodar o verificar depois de cada etapa e só parar com todos OK ou num portão humano.
Funciona no Claude Code e no Codex, porque o juiz é o mesmo script para os dois.
/goal, laço faz-verifica-corrige, execução longa.
Frases de parada escritas no goal para gasto, envio, apagar e publicar, e uma linha no FALHAS.md ou no LIMITES.md a cada problema.
Agente que persegue o OK por horas não pode decidir sozinho o que é irreversível.
Portão humano, teto da POLITICA, FALHAS.md, LIMITES.md.