Entenda que cada modelo tem força e preço
O Rui, 52, tem uma loja de materiais de construção. Para entregar um saco de cimento na rua de trás, ele manda a moto. Para entregar uma carga de tijolos, manda o caminhão. Ninguém usa caminhão para levar um parafuso.
Com os modelos de IA é igual. Os mais fortes resolvem problemas difíceis, mas consomem mais da sua cota. Os mais leves respondem rápido e gastam pouco. Escolher bem é usar o veículo certo para cada entrega.
🆕 Novo aqui? Três palavras deste módulo
- Modelo — o "cérebro" de IA que pensa e escreve. O Codex é o programa em volta; o modelo é quem raciocina lá dentro.
- Cota — o limite semanal de uso da sua assinatura. Não é dinheiro: é quanto trabalho você pode pedir na semana.
- Token — pedaço de texto que o modelo lê ou escreve. É a unidade que mede o gasto (tópico 3).
Como ler o desenho: os três veículos são três tipos de modelo. A régua de baixo mostra a troca: andar para a direita compra força e cobra cota. O ponto maior significa mais gasto por tarefa.
✗ Escolha no automático
- ✗ Usar sempre o modelo mais forte "por garantia"
- ✗ A cota acaba na quarta-feira
- ✗ Esperar mais por respostas simples
- ✗ Usar o mais fraco num problema difícil e refazer três vezes
✓ Escolha consciente
- ✓ Modelo do dia a dia para a maior parte do trabalho
- ✓ O mais forte só quando o problema pede
- ✓ O leve para tarefas curtas e repetitivas
- ✓ A cota dura a semana inteira
Conheça a família de modelos do Codex
No catálogo atual, a família principal tem três nomes. O GPT-6-Astra é o mais forte e o que mais consome. O GPT-6.1-Sol é o cavalo de trabalho do dia a dia. O GPT-6-Luna é rápido e econômico, feito para tarefas fáceis.
A geração anterior (GPT-5.6-Sol, Terra e Luna) ainda aparece na lista. Ela funciona, mas normalmente não há motivo para escolhê-la num trabalho novo.
Como ler o desenho: em cada cartão, a barra de cima é a força e a de baixo é o consumo de cota. Repare que as duas crescem juntas. A faixa cinza embaixo é a geração anterior, que continua disponível.
| Modelo | Perfil | Exemplo da Paula ou do Rui |
|---|---|---|
| GPT-6-Luna | Rápido, econômico | Rui corrige a ortografia das placas de promoção |
| GPT-6.1-Sol | Equilibrado, uso diário | Paula monta uma proposta a partir do modelo dela |
| GPT-6-Astra | O mais forte, consome mais | Rui pede uma análise do estoque do ano inteiro com sugestões de compra |
💡 Os nomes mudam, a lógica fica
Daqui a alguns meses a lista terá outros nomes. Não decore a lista: decore as três prateleiras. Sempre haverá um modelo forte e caro, um do dia a dia e um leve. Quando aparecer um nome novo, pergunte ao Codex em qual prateleira ele entra.
Entenda tokens de entrada e de saída
O modelo não lê palavras inteiras: ele lê tokens, pedaços de texto. Em média, um token tem uns 4 caracteres, cerca de ¾ de uma palavra. Pontuação e espaços também contam.
Existem dois lados. Entrada é tudo o que entra no modelo: seu pedido, o AGENTS.md, os arquivos e PDFs que ele abre. Saída é o que ele produz, incluindo o raciocínio. Token de saída custa mais que token de entrada.
Como ler o desenho: a linha de cima mostra uma frase partida em tokens. Embaixo, tudo o que está à esquerda do modelo é entrada; tudo o que sai à direita é saída. O raciocínio que ele faz antes de responder também conta como saída.
🆕 Novo aqui? Por que isso importa para você
Quando a Paula pede "leia estes 10 contratos e me diga quais vencem em novembro", a entrada é enorme (os 10 contratos) e a saída é pequena (uma lista). Quando ela pede "escreva 15 posts de LinkedIn", a entrada é pequena e a saída é grande. Os dois gastam cota, mas de jeitos diferentes. Pedidos claros e curtos e pastas organizadas economizam entrada; pedir só o que você vai usar economiza saída.
Diferencie assinatura de API
Existem duas formas de pagar por um modelo. A API é a porta para programas e automações: cobra por milhão de tokens, separando entrada e saída, e o modelo mais forte custa mais por token. É como pagar taxímetro.
No Codex, você entra com a conta do ChatGPT e usa a assinatura: um plano mensal com uma cota semanal. Para uso pessoal, ela rende muito mais do que pagar a mesma quantidade de trabalho pela API. É como ter um plano de quilometragem.
Como ler o desenho: à esquerda, a assinatura funciona como um medidor que enche durante a semana e volta a zero quando ela renova. À direita, a API é um taxímetro que nunca zera: cada token soma, e a saída gira mais depressa que a entrada.
✓ Assinatura serve para
- ✓ Trabalhar no Codex no dia a dia
- ✓ Gasto previsível: o plano é mensal
- ✓ Entrar com
codex loginusando a conta do ChatGPT - ✓ Se a cota acabar, dá para comprar créditos extras
✗ API não é para
- ✗ Substituir a assinatura no uso pessoal
- ✗ Quem não quer acompanhar consumo token a token
- ✗ Colar chave de API no AGENTS.md ou em arquivo comum
- ✗ Testar "só para ver" sem saber quanto vai consumir
💡 Acompanhe a cota antes de ela acabar
O aplicativo mostra quanto da cota semanal já foi usado (o nome da tela pode mudar entre versões; procure por "uso" ou "limites"). Se na terça você já gastou metade, é sinal de que está usando modelo forte demais para tarefas simples.
Troque de modelo no meio da conversa
Você não fica preso ao modelo com que começou. Dá para trocar entre uma mensagem e outra, na mesma conversa, sem perder o que já foi dito. A conversa continua; só muda quem vai pensar na próxima resposta.
A Paula faz assim: usa o modelo forte para desenhar a estrutura de um treinamento novo e, quando chega a hora de escrever os e-mails de convite, passa para o leve.
Como ler o desenho: a primeira resposta da conversa foi do Astra, a segunda do Luna. A troca aconteceu no seletor embaixo da caixa de mensagem, sem abrir conversa nova. Cada resposta carrega o modelo que a produziu.
Ache o seletor
No aplicativo, embaixo da caixa de mensagem, fica o seletor de modelo (junto com esforço e permissão). O nome do botão pode mudar entre versões; ele costuma mostrar o nome do modelo atual.
Escolha antes de enviar
A troca vale para a próxima mensagem. Escolha o modelo e só então escreva o pedido.
No terminal, escolha ao abrir
Use codex -m gpt-6-luna ou codex -m gpt-6-astra. Para mudar o padrão de todas as sessões, o arquivo ~/.codex/config.toml tem a linha model = "gpt-6-astra" (módulo 2.3).
Objetivo: começar uma sessão no terminal já com o GPT-6-Luna, para uma tarefa curta.
cd <caminho-da-sua-pasta> codex -m gpt-6-luna
Escolha o modelo pela tarefa
Três perguntas resolvem quase toda escolha. A tarefa é curta e repetitiva? Leve. É trabalho normal do dia, com arquivos e algum raciocínio? Dia a dia. É um problema difícil, longo, com muitas partes ou que você já tentou e não deu certo? Forte.
Usar o GPT-6-Astra para escrever um e-mail simples é desperdício de cota. Usar o GPT-6-Luna para planejar a reorganização do estoque do Rui é pedir para refazer depois.
Como ler o desenho: siga as setas a partir da tarefa. Os losangos são as perguntas; as caixas da direita são o modelo indicado. A estrela marca o caminho que você vai usar na maior parte da semana.
Objetivo: receber uma recomendação de modelo para as suas tarefas da semana, antes de gastar cota.
Esta semana eu preciso fazer: <liste suas tarefas, uma por linha>. Para cada uma, diga se eu devo usar o modelo leve (GPT-6-Luna), o do dia a dia (GPT-6.1-Sol) ou o mais forte (GPT-6-Astra), e explique em uma frase por quê. Não execute nenhuma tarefa ainda.
Teste rápido (opcional): o Rui precisa corrigir a ortografia de 10 placas de promoção. Qual modelo faz mais sentido?
🎓 Resumo do módulo
codex -m.Próximo módulo:
3.2 — Esforço e modo rápido