Pular para o conteúdo
MÓDULO 3.1 · CONCEITO 8 DE 18

🧠 Modelos: força e custo

O Codex não tem um cérebro só. Você escolhe qual modelo de IA vai trabalhar em cada conversa, e essa escolha decide duas coisas ao mesmo tempo: a qualidade da resposta e quanto da sua cota vai embora.

6
Tópicos
~30
Minutos
Base
Nível
Controle
Tipo
0 de 60%
Ilustração: três cérebros luminosos de tamanhos diferentes lado a lado, do pequeno e ágil ao grande e potente, cada um ligado a um medidor de consumo. A cena mostra que modelo mais forte entrega mais e também gasta mais cota.
1

Entenda que cada modelo tem força e preço

O Rui, 52, tem uma loja de materiais de construção. Para entregar um saco de cimento na rua de trás, ele manda a moto. Para entregar uma carga de tijolos, manda o caminhão. Ninguém usa caminhão para levar um parafuso.

Com os modelos de IA é igual. Os mais fortes resolvem problemas difíceis, mas consomem mais da sua cota. Os mais leves respondem rápido e gastam pouco. Escolher bem é usar o veículo certo para cada entrega.

🆕 Novo aqui? Três palavras deste módulo

  • Modelo — o "cérebro" de IA que pensa e escreve. O Codex é o programa em volta; o modelo é quem raciocina lá dentro.
  • Cota — o limite semanal de uso da sua assinatura. Não é dinheiro: é quanto trabalho você pode pedir na semana.
  • Token — pedaço de texto que o modelo lê ou escreve. É a unidade que mede o gasto (tópico 3).
🛵leve e rápidogasta pouco 🛻dia a diaequilíbrio 🚛mais fortegasta mais menos força · menos cotamais força · mais cota

Como ler o desenho: os três veículos são três tipos de modelo. A régua de baixo mostra a troca: andar para a direita compra força e cobra cota. O ponto maior significa mais gasto por tarefa.

✗ Escolha no automático

  • ✗ Usar sempre o modelo mais forte "por garantia"
  • ✗ A cota acaba na quarta-feira
  • ✗ Esperar mais por respostas simples
  • ✗ Usar o mais fraco num problema difícil e refazer três vezes

✓ Escolha consciente

  • ✓ Modelo do dia a dia para a maior parte do trabalho
  • ✓ O mais forte só quando o problema pede
  • ✓ O leve para tarefas curtas e repetitivas
  • ✓ A cota dura a semana inteira
2

Conheça a família de modelos do Codex

No catálogo atual, a família principal tem três nomes. O GPT-6-Astra é o mais forte e o que mais consome. O GPT-6.1-Sol é o cavalo de trabalho do dia a dia. O GPT-6-Luna é rápido e econômico, feito para tarefas fáceis.

A geração anterior (GPT-5.6-Sol, Terra e Luna) ainda aparece na lista. Ela funciona, mas normalmente não há motivo para escolhê-la num trabalho novo.

GPT-6-Luna força consumo rápido · tarefas fáceis GPT-6.1-Sol força consumo o dia a dia GPT-6-Astra força consumo problemas difíceis geração anterior: GPT-5.6-Sol · GPT-5.6-Terra · GPT-5.6-Luna

Como ler o desenho: em cada cartão, a barra de cima é a força e a de baixo é o consumo de cota. Repare que as duas crescem juntas. A faixa cinza embaixo é a geração anterior, que continua disponível.

ModeloPerfilExemplo da Paula ou do Rui
GPT-6-LunaRápido, econômicoRui corrige a ortografia das placas de promoção
GPT-6.1-SolEquilibrado, uso diárioPaula monta uma proposta a partir do modelo dela
GPT-6-AstraO mais forte, consome maisRui pede uma análise do estoque do ano inteiro com sugestões de compra

💡 Os nomes mudam, a lógica fica

Daqui a alguns meses a lista terá outros nomes. Não decore a lista: decore as três prateleiras. Sempre haverá um modelo forte e caro, um do dia a dia e um leve. Quando aparecer um nome novo, pergunte ao Codex em qual prateleira ele entra.

3

Entenda tokens de entrada e de saída

O modelo não lê palavras inteiras: ele lê tokens, pedaços de texto. Em média, um token tem uns 4 caracteres, cerca de ¾ de uma palavra. Pontuação e espaços também contam.

Existem dois lados. Entrada é tudo o que entra no modelo: seu pedido, o AGENTS.md, os arquivos e PDFs que ele abre. Saída é o que ele produz, incluindo o raciocínio. Token de saída custa mais que token de entrada.

Faça uma prop osta de trei namen to . 9 tokens (a divisão real varia; serve para dar a ideia) seu pedido AGENTS.md PDF de 20 páginas ENTRADA 🧠 modelo lê e pensa raciocínio+ resposta escrita+ arquivos que ele cria SAÍDA · custa mais por token

Como ler o desenho: a linha de cima mostra uma frase partida em tokens. Embaixo, tudo o que está à esquerda do modelo é entrada; tudo o que sai à direita é saída. O raciocínio que ele faz antes de responder também conta como saída.

🆕 Novo aqui? Por que isso importa para você

Quando a Paula pede "leia estes 10 contratos e me diga quais vencem em novembro", a entrada é enorme (os 10 contratos) e a saída é pequena (uma lista). Quando ela pede "escreva 15 posts de LinkedIn", a entrada é pequena e a saída é grande. Os dois gastam cota, mas de jeitos diferentes. Pedidos claros e curtos e pastas organizadas economizam entrada; pedir só o que você vai usar economiza saída.

4

Diferencie assinatura de API

Existem duas formas de pagar por um modelo. A API é a porta para programas e automações: cobra por milhão de tokens, separando entrada e saída, e o modelo mais forte custa mais por token. É como pagar taxímetro.

No Codex, você entra com a conta do ChatGPT e usa a assinatura: um plano mensal com uma cota semanal. Para uso pessoal, ela rende muito mais do que pagar a mesma quantidade de trabalho pela API. É como ter um plano de quilometragem.

Assinatura (Codex) 40% da cota usadarenova toda semana · plano mensal API (programas) entrada▮▮▯▯▯ saída▮▮▮▮▯ cobra por milhão de tokens bom para automação · caro para uso pessoal

Como ler o desenho: à esquerda, a assinatura funciona como um medidor que enche durante a semana e volta a zero quando ela renova. À direita, a API é um taxímetro que nunca zera: cada token soma, e a saída gira mais depressa que a entrada.

✓ Assinatura serve para

  • ✓ Trabalhar no Codex no dia a dia
  • ✓ Gasto previsível: o plano é mensal
  • ✓ Entrar com codex login usando a conta do ChatGPT
  • ✓ Se a cota acabar, dá para comprar créditos extras

✗ API não é para

  • ✗ Substituir a assinatura no uso pessoal
  • ✗ Quem não quer acompanhar consumo token a token
  • ✗ Colar chave de API no AGENTS.md ou em arquivo comum
  • ✗ Testar "só para ver" sem saber quanto vai consumir

💡 Acompanhe a cota antes de ela acabar

O aplicativo mostra quanto da cota semanal já foi usado (o nome da tela pode mudar entre versões; procure por "uso" ou "limites"). Se na terça você já gastou metade, é sinal de que está usando modelo forte demais para tarefas simples.

5

Troque de modelo no meio da conversa

Você não fica preso ao modelo com que começou. Dá para trocar entre uma mensagem e outra, na mesma conversa, sem perder o que já foi dito. A conversa continua; só muda quem vai pensar na próxima resposta.

A Paula faz assim: usa o modelo forte para desenhar a estrutura de um treinamento novo e, quando chega a hora de escrever os e-mails de convite, passa para o leve.

Projetos paula-escritorio loja-rui GPT-6-AstraEstrutura do treinamento em 4 módulos… GPT-6-LunaRascunho dos 3 e-mails de convite… mensagem… GPT-6-AstraGPT-6.1-Sol ✓ GPT-6-Luna seletor de modelo

Como ler o desenho: a primeira resposta da conversa foi do Astra, a segunda do Luna. A troca aconteceu no seletor embaixo da caixa de mensagem, sem abrir conversa nova. Cada resposta carrega o modelo que a produziu.

1

Ache o seletor

No aplicativo, embaixo da caixa de mensagem, fica o seletor de modelo (junto com esforço e permissão). O nome do botão pode mudar entre versões; ele costuma mostrar o nome do modelo atual.

2

Escolha antes de enviar

A troca vale para a próxima mensagem. Escolha o modelo e só então escreva o pedido.

3

No terminal, escolha ao abrir

Use codex -m gpt-6-luna ou codex -m gpt-6-astra. Para mudar o padrão de todas as sessões, o arquivo ~/.codex/config.toml tem a linha model = "gpt-6-astra" (módulo 2.3).

⌨️ Copia e cola: abrir o Codex com o modelo leve

Objetivo: começar uma sessão no terminal já com o GPT-6-Luna, para uma tarefa curta.

cd <caminho-da-sua-pasta>
codex -m gpt-6-luna
Como verificar: a tela de abertura do Codex mostra o modelo em uso. Tem de aparecer gpt-6-luna. Se aparecer outro, confira se digitou o nome exatamente como acima.
6

Escolha o modelo pela tarefa

Três perguntas resolvem quase toda escolha. A tarefa é curta e repetitiva? Leve. É trabalho normal do dia, com arquivos e algum raciocínio? Dia a dia. É um problema difícil, longo, com muitas partes ou que você já tentou e não deu certo? Forte.

Usar o GPT-6-Astra para escrever um e-mail simples é desperdício de cota. Usar o GPT-6-Luna para planejar a reorganização do estoque do Rui é pedir para refazer depois.

📋 tarefa curta erepetitiva? difícil, longaou já falhou? GPT-6-Luna GPT-6-Astra GPT-6.1-Sol ★ simnãosimnão

Como ler o desenho: siga as setas a partir da tarefa. Os losangos são as perguntas; as caixas da direita são o modelo indicado. A estrela marca o caminho que você vai usar na maior parte da semana.

💬 Copia e cola no Codex: deixe ele sugerir o modelo

Objetivo: receber uma recomendação de modelo para as suas tarefas da semana, antes de gastar cota.

Esta semana eu preciso fazer: <liste suas tarefas, uma por linha>. Para cada uma, diga se eu devo usar o modelo leve (GPT-6-Luna), o do dia a dia (GPT-6.1-Sol) ou o mais forte (GPT-6-Astra), e explique em uma frase por quê. Não execute nenhuma tarefa ainda.
Como verificar: a maior parte das tarefas deve cair no GPT-6.1-Sol. Se ele recomendar o Astra para quase tudo, peça "reveja pensando em economizar cota".

Teste rápido (opcional): o Rui precisa corrigir a ortografia de 10 placas de promoção. Qual modelo faz mais sentido?

🎓 Resumo do módulo

✓
Força e cota andam juntas — modelo mais forte gasta mais.
✓
Três prateleiras — Luna leve, Sol do dia a dia, Astra forte.
✓
Tokens de entrada e de saída — a saída, raciocínio incluído, custa mais.
✓
Assinatura, não API — cota semanal rende muito mais no uso pessoal.
✓
Troque quando quiser — no seletor ou com codex -m.

Próximo módulo:

3.2 — Esforço e modo rápido