Pular para o conteúdo
MÓDULO 3.2 · CONCEITO 9 DE 18

🎚️ Esforço e modo rápido

Escolher o modelo é metade da decisão. A outra metade é dizer quanto ele deve pensar antes de responder, e se você quer a resposta mais depressa pagando mais cota por isso.

6
Tópicos
~30
Minutos
Base
Nível
Controle
Tipo
0 de 60%
Ilustração: uma mesa de som futurista com controles deslizantes de esforço, do baixo ao máximo, e um botão separado de modo rápido. A cena ensina que você regula quanto o agente pensa e quanto de cota aceita gastar.
1

Entenda o que é nível de esforço

Pense numa pergunta feita a uma consultora experiente. "Que horas é a reunião?" ela responde na hora. "Como reestruturo o RH de uma empresa de 80 pessoas?" ela pede um tempo para pensar, rabisca, considera alternativas.

O nível de esforço é isso: quanto o modelo raciocina antes de responder. É o mesmo modelo, com a mesma inteligência, mas com mais ou menos tempo de "rascunho mental". Você regula esse botão em cada conversa.

🆕 Novo aqui? Duas palavras deste módulo

  • Raciocínio — o texto que o modelo escreve "para si mesmo" antes de responder: planeja, testa hipóteses, revisa. Você vê um resumo dele no registro da conversa (módulo 1.3).
  • Esforço — a configuração que diz quanto raciocínio ele pode fazer. Mais esforço, mais raciocínio, mais tokens de saída.
esforço baixo 🧠 "é às 15h" resposta esforço alto 🧠 1. listar áreas do RH2. demitir? não3. comparar 3 modelos4. checar custos e prazos5. revisar o plano resposta pensada

Como ler o desenho: o cérebro é o mesmo nos dois lados. O que muda é o tamanho da bolha de raciocínio. Com esforço alto, ele lista caminhos, descarta alguns (o riscado) e revisa antes de responder.

💡 Esforço não é "caprichar no texto"

Mais esforço não deixa um e-mail mais bonito. Ajuda quando há algo para descobrir: um erro escondido numa planilha, um plano com várias etapas, uma decisão com prós e contras. Se a tarefa não tem nada para "resolver", esforço alto só gasta.

2

Conheça a escada de low a ultra

São seis degraus, com nomes em inglês: low (baixo), medium (médio), high (alto), xhigh (extra alto), max (máximo) e ultra. Cada degrau pensa mais que o anterior.

O ultra é especial: além do raciocínio máximo, ele delega tarefas automaticamente, dividindo o trabalho com ajudantes (você verá isso nos subagentes, módulo 4.3). Atenção: o GPT-6-Luna vai só até max.

low medium high xhigh max ultra 🤖🤖🤖 delega sozinho GPT-6-Luna: low até max Sol e Astra: low até ultra ↑ cada degrau: mais raciocínio, mais tempo, mais cota

Como ler o desenho: cada degrau é um nível de esforço, e a altura mostra quanto ele pensa. O último degrau traz ajudantes porque o ultra delega partes do trabalho. As linhas de baixo mostram até onde cada modelo sobe.

NívelQuando faz sentidoExemplo
lowRespostas diretas, sem nada a descobrirRui pede para trocar "promoçao" por "promoção" no catálogo
mediumO padrão do trabalho de escritórioPaula escreve uma proposta usando o modelo dela
high / xhighProblemas com várias etapas ou um erro difícilRui descobre por que o estoque da planilha não bate com o caixa
maxQuando o resultado precisa ser o melhor possívelPaula desenha um programa de treinamento de 6 meses
ultraTrabalhos grandes que valem dividir entre ajudantesRui pede um diagnóstico completo da loja: estoque, preços e site
3

Veja por que mais esforço gasta mais cota

Lembra do módulo anterior? O raciocínio conta como token de saída, o tipo mais caro. Cada degrau a mais na escada significa mais texto de rascunho, e todo esse rascunho sai da sua cota, mesmo que você nunca leia.

É por isso que comparativos de modelos costumam mostrar o mesmo modelo em low, medium e high, com notas e custos diferentes. A qualidade sobe, mas cada degrau rende menos que o anterior, enquanto o gasto continua subindo.

melhor custo-benefício lowmediumhighxhighmaxultra cota consumidaqualidade da resposta

Como ler o desenho: as colunas roxas são o gasto, que cresce cada vez mais rápido. A linha azul é a qualidade, que sobe muito no começo e quase para de subir no fim. A faixa destacada é onde você ganha mais por cota gasta. Os números são ilustrativos: a forma das curvas é o que importa.

✓ Suba o esforço quando

  • ✓ A primeira resposta veio rasa ou errada
  • ✓ A tarefa tem várias etapas que dependem umas das outras
  • ✓ Existe um erro a encontrar (conta que não fecha, dado que some)
  • ✓ Errar sai caro: proposta para cliente grande, decisão de compra

✗ Não suba quando

  • ✗ É só formatar, traduzir ou corrigir ortografia
  • ✗ Você já sabe exatamente o que quer
  • ✗ A tarefa vai se repetir dezenas de vezes na semana
  • ✗ O problema é falta de informação: aí o que resolve é dar o arquivo certo
4

Use o modo rápido com consciência

O modo rápido (no aplicativo aparece como "Fast"; o nome do botão pode mudar entre versões) entrega a resposta com 2× mais velocidade. O preço é consumir mais cota pelo mesmo trabalho.

Repare que ele é diferente do esforço. O esforço muda quanto o modelo pensa. O modo rápido muda a velocidade com que ele entrega: o raciocínio é o mesmo, só chega antes. É como pagar a entrega expressa do mesmo produto.

normal chega no tempo 10 rápido ⚡ chega no tempo 5 (2×) cota cota mesma tarefa, mesmo raciocínio: muda a velocidade e o consumo

Como ler o desenho: as duas pistas fazem a mesma tarefa. A de baixo chega na metade do tempo, mas o tanque à direita mostra que ela gastou mais cota. Velocidade é o que você compra; a qualidade não muda.

✓ Vale ligar o modo rápido

  • ✓ O cliente da Paula está esperando na linha
  • ✓ Você está acompanhando e corrigindo a cada passo
  • ✓ A cota da semana está folgada

✗ Deixe desligado

  • ✗ Tarefas longas que você vai ver só depois
  • ✗ Objetivos com /goal que rodam sozinhos
  • ✗ Fim de semana da cota quase no limite

💡 Desligue depois de usar

O erro mais comum é ligar o modo rápido numa urgência e esquecer ligado pelo resto da semana. Criou o hábito de ligar? Crie também o de desligar assim que a urgência passar.

5

Combine modelo e esforço

Modelo e esforço são dois botões independentes. Um modelo leve com esforço alto pode render mais que um modelo forte com esforço baixo em certas tarefas, e às vezes gastando menos. A combinação é o que importa.

Para trabalho de escritório, a regra que resolve quase tudo é simples: modelo do dia a dia (GPT-6.1-Sol) em medium. Você sobe um botão de cada vez só quando a resposta não chega lá.

lowmediumhighxhighmaxultra GPT-6-LunaGPT-6.1-SolGPT-6-Astra ★ não existe ★ ponto de partida mais escuro = mais cota por tarefa

Como ler o desenho: cada célula é uma combinação de modelo e esforço; quanto mais intensa a cor, mais cota ela consome. Comece pela estrela. Se precisar de mais, ande uma casa para a direita (mais esforço) ou uma para baixo (modelo mais forte), nunca as duas de uma vez.

⌨️ Copia e cola: abrir com modelo e esforço escolhidos

Objetivo: abrir uma sessão no terminal com o modelo forte e esforço alto só para uma tarefa difícil, sem mudar o seu padrão.

codex -m gpt-6-astra -c model_reasoning_effort="high"

Para mudar o padrão de todas as sessões, o ~/.codex/config.toml guarda as duas linhas: model = "gpt-6-astra" e model_reasoning_effort = "medium". No aplicativo, os dois seletores ficam embaixo da caixa de mensagem.

Como verificar: a tela de abertura mostra o modelo e o esforço da sessão. Feche e abra de novo só com codex: o padrão anterior tem de voltar, porque o -c vale só para aquela sessão.
6

Monte sua tabela pessoal

Decidir modelo e esforço a cada conversa cansa. A saída é montar uma vez uma tabela pessoal: tarefa → modelo → esforço. Você consulta, escolhe e segue em frente.

A Paula guardou a dela na própria pasta, em paula-escritorio/tabela-modelos.md, e citou o arquivo no AGENTS.md. Assim, o Codex também sabe a preferência dela e avisa quando um pedido parece pedir outro nível.

📄 tabela-modelos.md tarefamodeloesforço posts do LinkedInGPT-6-Lunalow propostasGPT-6.1-Solmedium análise de contratosGPT-6.1-Solhigh plano anual de treinamentoGPT-6-Astramax 📜 AGENTS.md "veja tabela-modelos"

Como ler o desenho: a ficha roxa é a tabela da Paula, uma linha por tipo de tarefa. A seta mostra que o AGENTS.md aponta para ela, então o Codex lê a tabela em toda conversa nova do projeto.

1

Liste suas tarefas da semana

Cinco a oito tipos de trabalho que você repete. Não precisa ser completo.

2

Comece tudo em Sol + medium

Use uma semana assim. Anote onde a resposta veio fraca e onde foi exagero.

3

Ajuste uma casa por vez

Veio fraca? Suba o esforço. Ainda fraca? Troque para o Astra. Foi exagero? Desça para o Luna ou para low.

4

Salve e cite no AGENTS.md

Guarde a tabela na pasta do projeto e acrescente uma linha no AGENTS.md apontando para ela.

💬 Copia e cola no Codex: rascunho da sua tabela

Objetivo: ganhar um primeiro rascunho da tabela a partir do que já existe na sua pasta.

Olhe os arquivos deste projeto e as conversas anteriores dele e liste os tipos de tarefa que eu mais faço. Monte uma tabela "tarefa → modelo → esforço" usando GPT-6-Luna, GPT-6.1-Sol ou GPT-6-Astra e os níveis low, medium, high, xhigh ou max, pensando em economizar cota. Mostre a tabela aqui e só salve em tabela-modelos.md depois que eu aprovar.
Como verificar: a maioria das linhas deve ficar em GPT-6.1-Sol com medium. O arquivo só aparece na pasta depois do seu "pode salvar".

Teste rápido (opcional): o que o modo rápido muda?

🎓 Resumo do módulo

✓
Esforço = quanto ele pensa — mesmo modelo, mais ou menos raciocínio.
✓
Seis degraus — low, medium, high, xhigh, max e ultra (que delega).
✓
Raciocínio é saída — cada degrau gasta mais e rende um pouco menos.
✓
Modo rápido — 2× mais velocidade, mais cota; desligue depois.
✓
Sol + medium — ponto de partida; ajuste uma casa por vez.

Próximo módulo:

3.3 — Permissões: quanto ele faz sozinho