Entenda o que é nível de esforço
Pense numa pergunta feita a uma consultora experiente. "Que horas é a reunião?" ela responde na hora. "Como reestruturo o RH de uma empresa de 80 pessoas?" ela pede um tempo para pensar, rabisca, considera alternativas.
O nível de esforço é isso: quanto o modelo raciocina antes de responder. É o mesmo modelo, com a mesma inteligência, mas com mais ou menos tempo de "rascunho mental". Você regula esse botão em cada conversa.
🆕 Novo aqui? Duas palavras deste módulo
- Raciocínio — o texto que o modelo escreve "para si mesmo" antes de responder: planeja, testa hipóteses, revisa. Você vê um resumo dele no registro da conversa (módulo 1.3).
- Esforço — a configuração que diz quanto raciocínio ele pode fazer. Mais esforço, mais raciocínio, mais tokens de saída.
Como ler o desenho: o cérebro é o mesmo nos dois lados. O que muda é o tamanho da bolha de raciocínio. Com esforço alto, ele lista caminhos, descarta alguns (o riscado) e revisa antes de responder.
💡 Esforço não é "caprichar no texto"
Mais esforço não deixa um e-mail mais bonito. Ajuda quando há algo para descobrir: um erro escondido numa planilha, um plano com várias etapas, uma decisão com prós e contras. Se a tarefa não tem nada para "resolver", esforço alto só gasta.
Conheça a escada de low a ultra
São seis degraus, com nomes em inglês: low (baixo), medium (médio), high (alto), xhigh (extra alto), max (máximo) e ultra. Cada degrau pensa mais que o anterior.
O ultra é especial: além do raciocínio máximo, ele delega tarefas automaticamente, dividindo o trabalho com ajudantes (você verá isso nos subagentes, módulo 4.3). Atenção: o GPT-6-Luna vai só até max.
Como ler o desenho: cada degrau é um nível de esforço, e a altura mostra quanto ele pensa. O último degrau traz ajudantes porque o ultra delega partes do trabalho. As linhas de baixo mostram até onde cada modelo sobe.
| Nível | Quando faz sentido | Exemplo |
|---|---|---|
low | Respostas diretas, sem nada a descobrir | Rui pede para trocar "promoçao" por "promoção" no catálogo |
medium | O padrão do trabalho de escritório | Paula escreve uma proposta usando o modelo dela |
high / xhigh | Problemas com várias etapas ou um erro difícil | Rui descobre por que o estoque da planilha não bate com o caixa |
max | Quando o resultado precisa ser o melhor possível | Paula desenha um programa de treinamento de 6 meses |
ultra | Trabalhos grandes que valem dividir entre ajudantes | Rui pede um diagnóstico completo da loja: estoque, preços e site |
Veja por que mais esforço gasta mais cota
Lembra do módulo anterior? O raciocínio conta como token de saída, o tipo mais caro. Cada degrau a mais na escada significa mais texto de rascunho, e todo esse rascunho sai da sua cota, mesmo que você nunca leia.
É por isso que comparativos de modelos costumam mostrar o mesmo modelo em low, medium e high, com notas e custos diferentes. A qualidade sobe, mas cada degrau rende menos que o anterior, enquanto o gasto continua subindo.
Como ler o desenho: as colunas roxas são o gasto, que cresce cada vez mais rápido. A linha azul é a qualidade, que sobe muito no começo e quase para de subir no fim. A faixa destacada é onde você ganha mais por cota gasta. Os números são ilustrativos: a forma das curvas é o que importa.
✓ Suba o esforço quando
- ✓ A primeira resposta veio rasa ou errada
- ✓ A tarefa tem várias etapas que dependem umas das outras
- ✓ Existe um erro a encontrar (conta que não fecha, dado que some)
- ✓ Errar sai caro: proposta para cliente grande, decisão de compra
✗ Não suba quando
- ✗ É só formatar, traduzir ou corrigir ortografia
- ✗ Você já sabe exatamente o que quer
- ✗ A tarefa vai se repetir dezenas de vezes na semana
- ✗ O problema é falta de informação: aí o que resolve é dar o arquivo certo
Use o modo rápido com consciência
O modo rápido (no aplicativo aparece como "Fast"; o nome do botão pode mudar entre versões) entrega a resposta com 2× mais velocidade. O preço é consumir mais cota pelo mesmo trabalho.
Repare que ele é diferente do esforço. O esforço muda quanto o modelo pensa. O modo rápido muda a velocidade com que ele entrega: o raciocínio é o mesmo, só chega antes. É como pagar a entrega expressa do mesmo produto.
Como ler o desenho: as duas pistas fazem a mesma tarefa. A de baixo chega na metade do tempo, mas o tanque à direita mostra que ela gastou mais cota. Velocidade é o que você compra; a qualidade não muda.
✓ Vale ligar o modo rápido
- ✓ O cliente da Paula está esperando na linha
- ✓ Você está acompanhando e corrigindo a cada passo
- ✓ A cota da semana está folgada
✗ Deixe desligado
- ✗ Tarefas longas que você vai ver só depois
- ✗ Objetivos com
/goalque rodam sozinhos - ✗ Fim de semana da cota quase no limite
💡 Desligue depois de usar
O erro mais comum é ligar o modo rápido numa urgência e esquecer ligado pelo resto da semana. Criou o hábito de ligar? Crie também o de desligar assim que a urgência passar.
Combine modelo e esforço
Modelo e esforço são dois botões independentes. Um modelo leve com esforço alto pode render mais que um modelo forte com esforço baixo em certas tarefas, e às vezes gastando menos. A combinação é o que importa.
Para trabalho de escritório, a regra que resolve quase tudo é simples: modelo do dia a dia (GPT-6.1-Sol) em medium. Você sobe um botão de cada vez só quando a resposta não chega lá.
Como ler o desenho: cada célula é uma combinação de modelo e esforço; quanto mais intensa a cor, mais cota ela consome. Comece pela estrela. Se precisar de mais, ande uma casa para a direita (mais esforço) ou uma para baixo (modelo mais forte), nunca as duas de uma vez.
Objetivo: abrir uma sessão no terminal com o modelo forte e esforço alto só para uma tarefa difícil, sem mudar o seu padrão.
codex -m gpt-6-astra -c model_reasoning_effort="high"
Para mudar o padrão de todas as sessões, o ~/.codex/config.toml guarda as duas linhas: model = "gpt-6-astra" e model_reasoning_effort = "medium". No aplicativo, os dois seletores ficam embaixo da caixa de mensagem.
codex: o padrão anterior tem de voltar, porque o -c vale só para aquela sessão.Monte sua tabela pessoal
Decidir modelo e esforço a cada conversa cansa. A saída é montar uma vez uma tabela pessoal: tarefa → modelo → esforço. Você consulta, escolhe e segue em frente.
A Paula guardou a dela na própria pasta, em paula-escritorio/tabela-modelos.md, e citou o arquivo no AGENTS.md. Assim, o Codex também sabe a preferência dela e avisa quando um pedido parece pedir outro nível.
Como ler o desenho: a ficha roxa é a tabela da Paula, uma linha por tipo de tarefa. A seta mostra que o AGENTS.md aponta para ela, então o Codex lê a tabela em toda conversa nova do projeto.
Liste suas tarefas da semana
Cinco a oito tipos de trabalho que você repete. Não precisa ser completo.
Comece tudo em Sol + medium
Use uma semana assim. Anote onde a resposta veio fraca e onde foi exagero.
Ajuste uma casa por vez
Veio fraca? Suba o esforço. Ainda fraca? Troque para o Astra. Foi exagero? Desça para o Luna ou para low.
Salve e cite no AGENTS.md
Guarde a tabela na pasta do projeto e acrescente uma linha no AGENTS.md apontando para ela.
Objetivo: ganhar um primeiro rascunho da tabela a partir do que já existe na sua pasta.
Olhe os arquivos deste projeto e as conversas anteriores dele e liste os tipos de tarefa que eu mais faço. Monte uma tabela "tarefa → modelo → esforço" usando GPT-6-Luna, GPT-6.1-Sol ou GPT-6-Astra e os níveis low, medium, high, xhigh ou max, pensando em economizar cota. Mostre a tabela aqui e só salve em tabela-modelos.md depois que eu aprovar.
medium. O arquivo só aparece na pasta depois do seu "pode salvar".Teste rápido (opcional): o que o modo rápido muda?
🎓 Resumo do módulo
Próximo módulo:
3.3 — Permissões: quanto ele faz sozinho