Como ler: à esquerda, a prova (módulo 6.1): o mentor passa pelos testes e o que falha volta, em ciano, como correção do kit que chega pelo --atualizar. À direita, a evolução (módulo 6.2): conteúdo novo entra pela ingestão, e o mesmo desenho gera outros mentores. O ciclo não fecha nunca — e é por isso que o mentor não envelhece.
🧰 Antes de começar
O que você precisa
- • O seu mentor gerado, com as fases 1 a 3 com exit 0 (trilhas 2 a 4).
- • Agente, skills e portão no lugar (trilha 5).
- • Um link novo do especialista, que não esteja no ESCOPO.md.
- • O repositório do mentor em git, com tudo commitado.
O espírito da trilha
- • Placar honesto: parcial é parcial, mesmo que o resto esteja ótimo.
- • Evidência é arquivo ou log, nunca a frase do mentor sobre si mesmo.
- • Problema vai para o diário; correção vai para a próxima versão.
- • Duas tentativas sem avanço: pare e mude o mecanismo, não a redação.
Mapa da trilha
Conteúdo detalhado
🧪 O piloto real e os testes de aceitação
Os 3 testes congelados, o que passou no mentor do Nei, as 3 rodadas do teste 2 que nunca escreveram a previsão antes de rodar e a 4ª, em que o portão de previsão do kit 1.3 resolveu, a lição central — instrução não basta, precisa de mecanismo e de verificação de fora — e o placar final 5/5, nota 8 (4/5 até o 1.3).
Três tarefas fixas, rodadas numa sessão nova, cada uma com um critério de aprovação escrito antes e conferível por comando ou arquivo.
"Parece bom" não diz se o mentor funciona. Cada teste caça um mau hábito da IA que ensina.
Teste congelado · transcript como testemunha · decisão definida antes (5/5, 3–4/5, ≤ 2/5).
O mentor ensinou um hook Stop para TODO.md seguindo o loop inteiro, com uma versão quebrada real (loop infinito, 6 bloqueios em 6) e a correção com teto de 3.
É o exemplo de como um teste que passa se parece: previsão antes, saída real, quebra provocada e prova numa sessão de verdade.
Critério de aborto · validador com --transcript → 14 Bash, exit 0 · "aprendi algo" também é critério.
A revisão do script_emoji.py: reproduziu a quebra em cp1252, achou o 🤔 dentro do JSON de entrada, corrigiu na saída e provou com md5 — mas rodou antes de escrever a previsão.
Previsão escrita depois de rodar é narração. Sem o número no papel antes, não dá para saber se o mentor entendeu ou só reagiu.
cp1252 · reconfigure(errors="replace") · lado a lado com md5 · R3.
Kit 1.2 corrigiu a revisão e o teste rodou mais duas vezes, a última com instrução explícita. Mesmo comportamento; o validador com log reprovou as duas. Na rodada 4, com o portão de previsão do kit 1.3, o mentor previu antes de rodar e o validador aprovou.
A sessão declarou "o validador passa" porque o rodou sem o log. O texto do mentor sobre o próprio processo não é evidência.
--perfil revisao · --transcript · parar após 2 tentativas sem avanço.
Três camadas de garantia: instrução (pode ser ignorada), mecanismo (hook que impede) e verificação de fora (programa que lê o log).
É a lição que vale para qualquer agente, não só para mentores: pedir não garante; impedir e conferir garantem.
Portão de execução · portão de previsão PreToolUse (kit 1.3) · validar_resposta --transcript.
A ingestão de um guia novo em 2,4 min e o placar completo do piloto (5/5 no fim; 4/5 até o kit 1.3), com as 8 correções que viraram o kit 1.2 e o que o 1.3 fechou.
Você vai registrar o seu placar no mesmo formato, com evidência em cada linha.
RESULTADOS.md · diário sem consertar durante · limitação declarada, não escondida.
🌱 Ingestão contínua, atualização e reuso
O /ingere no caso real (guia novo → 2 métodos, R9 e R10), a promoção de regras, o novo-mentor.py --atualizar (o que muda e o que não), o reuso para outro especialista, o conselho de mentores e o projeto final com a rubrica de 10 pontos.
A skill que coleta uma fonte nova, cria a página dela, propaga pelas páginas afetadas, mexe nas regras e registra em index, hot e log.
Sem ingestão, o mentor congela no dia em que foi gerado e você volta a editar a wiki à mão.
Propagar nos dois sentidos · trava contra duplicação · 3 validadores com exit 0.
O momento em que uma regra com uma fonte só ganha a 2ª fonte diferente e passa a guiar o mentor. Reforço acrescenta citação sem mudar status.
É assim que o mentor fica mais fiel à pessoa com o tempo, sem inventar: cada regra ativa tem duas provas.
ativa · banco · inferência · R9 e R10 nasceram ativas no piloto.
O comando que troca tools/ e .claude/ pela versão nova do kit, com backup, e só acrescenta chaves novas no config.
As correções do piloto chegam ao seu mentor sem você perder acervo, wiki, regras ou respostas.
ATUALIZÁVEL × conteúdo · .mentor/backup-<data> · commit antes, validadores depois.
Gerar um segundo mentor com o mesmo kit, adaptar as seções para domínios que não são código ou portar o núcleo para outro agente.
O trabalho pesado é o método; o especialista é a variável. Sem hooks, a verificação de fora vira a única garantia.
Núcleo independente de agente · secoes_resposta · metas calibradas depois das fontes.
Vários mentores num projeto seu, consultados separadamente sobre a mesma pergunta e comparados numa tabela.
A divergência entre métodos mostra o que uma visão só esconde — e a concordância, lembra a R9, não é prova.
Subagente por mentor · artefato real, não resumo · o humano decide.
O mentor completo de um especialista à sua escolha, com 6 entregas e uma rubrica em que quase tudo se prova por comando.
É o fechamento do curso: você sai com um mentor que passou na prova, não com anotações.
20–50 fontes, ~50 mil palavras · autoavaliação por comando · demonstração de portão e ingestão.