TRILHA 6 · PROVA E EVOLUÇÃO

🧪 Prova e evolução

O mentor está montado. Agora ele precisa provar que funciona — e continuar funcionando. Esta trilha conta o piloto real com o mentor do Nei, com o que passou e o que falhou, e mostra como o mentor cresce com conteúdo novo, recebe as correções do kit e serve de molde para outros especialistas.

2
Módulos
12
Tópicos
~2h
Duração
5/5
Placar do piloto (kit 1.3)
0%0 de 12
seu mentor acervo · wiki · regras 3 testes de aceitação ensinar · revisar · ingerir placar + diário piloto: 5/5, nota 8 kit novo → --atualizar correções sem perder conteúdo /ingere conteúdo novo do especialista reuso · conselho outros especialistas o que falha vira versão nova 6.1 prova | 6.2 evolução

Como ler: à esquerda, a prova (módulo 6.1): o mentor passa pelos testes e o que falha volta, em ciano, como correção do kit que chega pelo --atualizar. À direita, a evolução (módulo 6.2): conteúdo novo entra pela ingestão, e o mesmo desenho gera outros mentores. O ciclo não fecha nunca — e é por isso que o mentor não envelhece.

🧰 Antes de começar

O que você precisa

  • • O seu mentor gerado, com as fases 1 a 3 com exit 0 (trilhas 2 a 4).
  • • Agente, skills e portão no lugar (trilha 5).
  • • Um link novo do especialista, que não esteja no ESCOPO.md.
  • • O repositório do mentor em git, com tudo commitado.

O espírito da trilha

  • • Placar honesto: parcial é parcial, mesmo que o resto esteja ótimo.
  • • Evidência é arquivo ou log, nunca a frase do mentor sobre si mesmo.
  • • Problema vai para o diário; correção vai para a próxima versão.
  • • Duas tentativas sem avanço: pare e mude o mecanismo, não a redação.

Mapa da trilha

Conteúdo detalhado

6.1~60 min

🧪 O piloto real e os testes de aceitação

Os 3 testes congelados, o que passou no mentor do Nei, as 3 rodadas do teste 2 que nunca escreveram a previsão antes de rodar e a 4ª, em que o portão de previsão do kit 1.3 resolveu, a lição central — instrução não basta, precisa de mecanismo e de verificação de fora — e o placar final 5/5, nota 8 (4/5 até o 1.3).

O que é:

Três tarefas fixas, rodadas numa sessão nova, cada uma com um critério de aprovação escrito antes e conferível por comando ou arquivo.

Por que aprender:

"Parece bom" não diz se o mentor funciona. Cada teste caça um mau hábito da IA que ensina.

Conceitos-chave:

Teste congelado · transcript como testemunha · decisão definida antes (5/5, 3–4/5, ≤ 2/5).

O que é:

O mentor ensinou um hook Stop para TODO.md seguindo o loop inteiro, com uma versão quebrada real (loop infinito, 6 bloqueios em 6) e a correção com teto de 3.

Por que aprender:

É o exemplo de como um teste que passa se parece: previsão antes, saída real, quebra provocada e prova numa sessão de verdade.

Conceitos-chave:

Critério de aborto · validador com --transcript → 14 Bash, exit 0 · "aprendi algo" também é critério.

O que é:

A revisão do script_emoji.py: reproduziu a quebra em cp1252, achou o 🤔 dentro do JSON de entrada, corrigiu na saída e provou com md5 — mas rodou antes de escrever a previsão.

Por que aprender:

Previsão escrita depois de rodar é narração. Sem o número no papel antes, não dá para saber se o mentor entendeu ou só reagiu.

Conceitos-chave:

cp1252 · reconfigure(errors="replace") · lado a lado com md5 · R3.

O que é:

Kit 1.2 corrigiu a revisão e o teste rodou mais duas vezes, a última com instrução explícita. Mesmo comportamento; o validador com log reprovou as duas. Na rodada 4, com o portão de previsão do kit 1.3, o mentor previu antes de rodar e o validador aprovou.

Por que aprender:

A sessão declarou "o validador passa" porque o rodou sem o log. O texto do mentor sobre o próprio processo não é evidência.

Conceitos-chave:

--perfil revisao · --transcript · parar após 2 tentativas sem avanço.

O que é:

Três camadas de garantia: instrução (pode ser ignorada), mecanismo (hook que impede) e verificação de fora (programa que lê o log).

Por que aprender:

É a lição que vale para qualquer agente, não só para mentores: pedir não garante; impedir e conferir garantem.

Conceitos-chave:

Portão de execução · portão de previsão PreToolUse (kit 1.3) · validar_resposta --transcript.

O que é:

A ingestão de um guia novo em 2,4 min e o placar completo do piloto (5/5 no fim; 4/5 até o kit 1.3), com as 8 correções que viraram o kit 1.2 e o que o 1.3 fechou.

Por que aprender:

Você vai registrar o seu placar no mesmo formato, com evidência em cada linha.

Conceitos-chave:

RESULTADOS.md · diário sem consertar durante · limitação declarada, não escondida.

Ver Completo
6.2~60 min

🌱 Ingestão contínua, atualização e reuso

O /ingere no caso real (guia novo → 2 métodos, R9 e R10), a promoção de regras, o novo-mentor.py --atualizar (o que muda e o que não), o reuso para outro especialista, o conselho de mentores e o projeto final com a rubrica de 10 pontos.

O que é:

A skill que coleta uma fonte nova, cria a página dela, propaga pelas páginas afetadas, mexe nas regras e registra em index, hot e log.

Por que aprender:

Sem ingestão, o mentor congela no dia em que foi gerado e você volta a editar a wiki à mão.

Conceitos-chave:

Propagar nos dois sentidos · trava contra duplicação · 3 validadores com exit 0.

O que é:

O momento em que uma regra com uma fonte só ganha a 2ª fonte diferente e passa a guiar o mentor. Reforço acrescenta citação sem mudar status.

Por que aprender:

É assim que o mentor fica mais fiel à pessoa com o tempo, sem inventar: cada regra ativa tem duas provas.

Conceitos-chave:

ativa · banco · inferência · R9 e R10 nasceram ativas no piloto.

O que é:

O comando que troca tools/ e .claude/ pela versão nova do kit, com backup, e só acrescenta chaves novas no config.

Por que aprender:

As correções do piloto chegam ao seu mentor sem você perder acervo, wiki, regras ou respostas.

Conceitos-chave:

ATUALIZÁVEL × conteúdo · .mentor/backup-<data> · commit antes, validadores depois.

O que é:

Gerar um segundo mentor com o mesmo kit, adaptar as seções para domínios que não são código ou portar o núcleo para outro agente.

Por que aprender:

O trabalho pesado é o método; o especialista é a variável. Sem hooks, a verificação de fora vira a única garantia.

Conceitos-chave:

Núcleo independente de agente · secoes_resposta · metas calibradas depois das fontes.

O que é:

Vários mentores num projeto seu, consultados separadamente sobre a mesma pergunta e comparados numa tabela.

Por que aprender:

A divergência entre métodos mostra o que uma visão só esconde — e a concordância, lembra a R9, não é prova.

Conceitos-chave:

Subagente por mentor · artefato real, não resumo · o humano decide.

O que é:

O mentor completo de um especialista à sua escolha, com 6 entregas e uma rubrica em que quase tudo se prova por comando.

Por que aprender:

É o fechamento do curso: você sai com um mentor que passou na prova, não com anotações.

Conceitos-chave:

20–50 fontes, ~50 mil palavras · autoavaliação por comando · demonstração de portão e ingestão.

Ver Completo
← Trilha 5: Agente, skills e portão Voltar ao início do curso