Entenda o que é um harness
O modelo de IA, sozinho, só sabe uma coisa: ler texto e escrever texto. Ele não abre arquivo, não roda programa, não navega em site. Alguém precisa dar mãos a ele.
Esse "alguém" é o harness, palavra inglesa para arreio. É o programa que prende o modelo a um conjunto de ferramentas e o faz trabalhar em ciclo. O Codex é um harness: o modelo é o cérebro, o Codex é o corpo com as mãos.
🆕 Novo aqui? Quatro palavras deste módulo
- Modelo — a IA que pensa e escreve (por exemplo, o GPT-6.1-Sol). Você escolhe qual usar na Trilha 3.
- Harness — o programa em volta do modelo que dá ferramentas e o ciclo de trabalho. O Codex é um harness.
- Ferramenta — uma ação que o agente pode executar: ler arquivo, escrever arquivo, rodar comando, abrir site.
- Ciclo do agente — a repetição pensar → agir com uma ferramenta → olhar o resultado, até poder responder.
Como ler o desenho: o círculo verde é o modelo, que só pensa. O anel tracejado azul é o Codex, que liga o modelo às quatro ferramentas dos cantos. Sem o anel, o modelo seria só um chat.
💡 Mesmo modelo, resultado diferente
O mesmo modelo rende mais dentro do Codex do que num chat, porque ali ele pode conferir o próprio trabalho: abre o arquivo, vê se ficou certo e corrige. O harness é metade do resultado.
✗ Modelo sem harness (chat)
- ✗ Só vê o que você cola na conversa
- ✗ Responde de uma vez, sem conferir
- ✗ Não cria nem altera arquivos
- ✗ Você faz o trabalho braçal
✓ Modelo dentro do Codex
- ✓ Abre os arquivos da pasta sozinho
- ✓ Confere o resultado antes de responder
- ✓ Salva o trabalho direto no projeto
- ✓ Você revisa em vez de executar
Siga o ciclo pensar, agir, responder
Quando você manda um pedido, o Codex não sai escrevendo a resposta. Primeiro ele pensa no que precisa. Depois escolhe uma ferramenta e a usa. Olha o resultado. Pensa de novo.
Esse vaivém se repete até ele ter o que precisa. Só então ele responde. Um pedido simples pode levar uma volta; um pedido grande pode levar dezenas.
Como ler o desenho: o triângulo azul gira enquanto falta informação. Quando, ao pensar, ele conclui que já tem tudo, sai pela seta verde e escreve a resposta. A resposta é o último passo, nunca o primeiro.
Pensa
A Paula pede "um e-mail de retorno para a cliente Acme". Ele pensa: "preciso saber o que já foi combinado".
Age
Usa a ferramenta de leitura e abre clientes/acme.md, seguindo o mapa de rotas do AGENTS.md.
Olha e pensa de novo
Vê que a proposta foi enviada há dez dias. Decide abrir também o modelo modelos/email-retorno.md.
Responde
Com os dois arquivos lidos, escreve o e-mail no tom da Paula, citando a proposta certa.
Abra o registro do que ele fez
O ciclo não é escondido. No aplicativo, perto da resposta, aparece uma linha curta com algo como "trabalhou por 25 s". Clicando nela, o registro se abre.
Ali você vê o raciocínio resumido e cada ação, na ordem: que arquivo ele leu, que comando rodou, que conversa anterior consultou. O texto exato e o lugar da linha podem mudar entre versões, mas o registro está sempre por perto da resposta.
Como ler o desenho: o quadro verde é o registro aberto. Leia de cima para baixo: é a ordem real em que ele pensou e agiu. A resposta cinza embaixo é só o resultado final dessa sequência. O desenho é um esboço, não a tela exata.
💡 Desconfiou? Abra o registro
Se a resposta parecer inventada, o registro mostra se ele leu mesmo o arquivo ou chutou. Resposta sem nenhuma leitura de arquivo, sobre algo que está na sua pasta, é sinal para pedir: "leia o arquivo antes de responder".
🆕 Novo aqui? Registro e raciocínio resumido
O registro é a lista de ações que o agente executou naquela resposta. O raciocínio resumido é uma versão curta do que ele pensou entre uma ação e outra. Não é o pensamento completo, mas basta para entender o caminho.
Aprenda olhando o agente trabalhar
O registro não serve só para conferir. Ele ensina. Veja que arquivos o agente abre e em que ordem. Isso mostra como ele "enxerga" a sua pasta.
Se ele abre cinco arquivos errados antes do certo, falta uma linha no mapa de rotas. Se ele procura algo que não existe, falta um arquivo na pasta. O Rui descobriu assim que nunca tinha salvo a tabela de preços de fornecedor.
Como ler o desenho: cada ponto é uma leitura, na ordem em que aconteceu. Vermelho é desvio, verde é acerto, amarelo é busca por algo que não está lá. Os quadros embaixo dizem o que corrigir em cada caso.
✓ Sinais de pasta boa
- ✓ Ele vai direto ao arquivo certo
- ✓ Poucas leituras para pedidos comuns
- ✓ Usa os exemplos que você indicou
- ✓ Termina rápido em tarefas repetidas
✗ Sinais de que falta algo
- ✗ Abre vários arquivos até achar o certo
- ✗ Procura um nome de arquivo que não existe
- ✗ Pergunta de novo algo que você já explicou
- ✗ Ignora o arquivo de estilo
Diferencie regras de memórias
No registro, às vezes aparece uma leitura de "memória". Não confunda com o AGENTS.md. São duas coisas diferentes, e cada uma tem o seu lugar.
Regras dizem como trabalhar: "propostas em uma página". Memórias são fatos lembrados: "a Paula prefere reuniões às terças" ou "a cliente Acme pediu desconto em setembro". Regra é manual; memória é caderno de anotações.
Como ler o desenho: o quadro verde guarda o jeito de trabalhar e quase não muda. O caderno azul guarda fatos e cresce com o uso. Os dois alimentam o mesmo pensamento, mas você edita cada um por um motivo diferente.
| Frase | É regra ou memória? | Onde fica |
|---|---|---|
| "Preço sempre com unidade (por saco, por m²)" | Regra | AGENTS.md da loja |
| "O fornecedor de cimento entrega às quartas" | Memória | Anotação lembrada |
| "Nunca envie e-mail sem mostrar antes" | Regra | AGENTS.md |
| "A cliente Acme tem 40 funcionários" | Fato do cliente | clientes/acme.md |
O que olhar na tabela: se a frase diz "faça" ou "nunca faça", é regra. Se conta algo que aconteceu ou que é verdade sobre alguém, é memória ou dado de cliente. Dados importantes de cliente merecem arquivo próprio na pasta.
Faça um pedido e acompanhe o ciclo
Hora de ver o ciclo com os próprios olhos. O melhor pedido para isso é um que obrigue o Codex a buscar dados, porque cada busca vira uma volta visível no registro.
O Rui usou a planilha de estoque da loja. Ele não quer só a lista: quer ver como o agente chegou nela. Faça igual com um arquivo seu.
Objetivo: fazer o agente ler um arquivo, filtrar os dados e responder, e depois conferir cada passo no registro.
Leia o arquivo estoque.csv e liste os 5 itens com menos de 10 unidades, do menor para o maior. Para cada item, mostre nome, quantidade e fornecedor. No fim, diga em uma frase quais arquivos você abriu para chegar nessa lista. Não altere nenhum arquivo.
estoque.csv. Depois abra a planilha você mesmo e confira dois itens da lista.Como ler o desenho: cada degrau é uma volta do ciclo que aparece no registro. A resposta só chega no topo, depois da última conferência. No seu teste, o número de degraus pode ser outro: o importante é ver a leitura do arquivo antes da resposta.
Teste rápido (opcional): o que o Codex faz quando recebe um pedido que exige dados da pasta?
🎓 Resumo do módulo
Próximo módulo:
1.4 — /goal: um objetivo até o fim