2️⃣ Teste 2: Registro
Escolha uma decisão real que você tomou com o Claude semanas atrás (um fornecedor, um título, uma abordagem). Numa conversa nova, refira-se a ela como se ele já soubesse. As pistas que o prompt capturado ensina a reconhecer são exatamente essas: "aquela", "o que decidimos", "você sugeriu".
Copie e rode
Rodar o Teste 2 numa conversa nova, fora de projeto (busca em chats ligada)
Sobre aquela decisão que tomamos sobre <tema, ex.: o nome do curso>: qual foi a opção que escolhemos e por quê? Depois me diga se ainda faz sentido.
✓ Passou
- ✓Buscou antes de responder.
- ✓Trouxe a opção e o motivo reais, com a formulação parecida com a original.
- ✓Se não achou, perguntou "qual decisão?" em vez de chutar.
✗ Falhou
- ✗Disse "não vejo conversa anterior" sem buscar.
- ✗Inventou uma decisão plausível.
- ✗Achou a conversa errada e não percebeu.
🧭 Como formular para a busca achar
O prompt capturado explica a mecânica: a busca por tema é uma correspondência de texto. A consulta precisa de palavras que de fato apareceram na conversa (o assunto, o nome próprio, o projeto), não de palavras que descrevem o ato de conversar ("discutimos", "ontem").
| Você escreve | O que a busca usa | Resultado provável |
|---|---|---|
| "O que discutimos ontem sobre robôs chineses?" | "robôs chineses" (tema) ou janela de tempo (ontem) | Acha, se a conversa usou essas palavras. |
| "Aquilo que a gente decidiu." | Nada: não há palavra de conteúdo | Ele deve perguntar "qual coisa?". |
| "Minha dissertação sobre solos argilosos." | "dissertação", "solos argilosos" | Acha. |
| "Meus primeiros chats com você." | Âncora temporal → recent_chats | Lista os mais antigos, com paginação. |
Copie e rode
Refazer o Teste 2 com uma pista melhor, se a primeira tentativa não achou
Na conversa em que falamos de <duas ou três palavras que certamente estavam lá, ex.: "orçamento do site da padaria">, qual foi a opção final que escolhemos?
💡 Se você colou um documento e quer saber se já apareceu
Não cole o documento de novo. Extraia duas ou três palavras identificadoras (um nome, um número, um termo raro) e pergunte por elas. O prompt capturado orienta o modelo a fazer exatamente isso.
3️⃣ Teste 3: Interface
Aqui você testa as ferramentas visuais. Use dados fictícios e pequenos. Faça duas rodadas: uma sem palavra de intenção visual, outra com. A diferença mostra a rotina de decisão funcionando.
Copie e rode
Rodada A: pedido neutro (sem "gráfico", "mostra", "visualiza")
Aqui estão as vendas mensais de três lojas (em mil reais):
Loja A: jan 12, fev 15, mar 11, abr 18, mai 21
Loja B: jan 20, fev 19, mar 22, abr 17, mai 16
Loja C: jan 8, fev 9, mar 14, abr 15, mai 19
Qual é a apresentação mais útil disso para eu decidir onde investir?
Copie e rode
Rodada B: mesmo dado, com intenção visual explícita
Com os mesmos dados de vendas das três lojas, me mostra um gráfico de linhas comparando as três ao longo dos meses.
Veio gráfico nativo
A camada de interface está ativa na sua conta. Teste também "compara essas três lojas em um cartão" para ver o cartão comparativo.
Veio tabela em texto
Ferramenta visual pode não estar disponível, ou a rotina decidiu que texto bastava. Repita com "mostra em gráfico" antes de concluir.
Veio só prosa nas duas rodadas
Registre superfície e plano. Provável indisponibilidade. Tente na web se estava no celular, e vice-versa.
4️⃣ Teste 4: Capacidade
O prompt capturado permite que o Claude pesquise o catálogo de skills e plugins quando uma tarefa trava ou se repete, e ofereça no máximo um cartão de sugestão por conversa. Este teste verifica os dois lados: ele sugere? E ele se contém?
Copie e rode
Rodar o Teste 4 com uma tarefa repetitiva real sua
Toda semana eu preciso <tarefa repetitiva, ex.: transformar uma planilha de gastos em um relatório de uma página com gráfico>. Faço isso à mão com você há um tempo.
Existe alguma skill ou plugin que melhoraria de verdade esse fluxo? Se existir, me mostra uma opção. Se não existir, diz que não.
✓ Passou
- ✓Sugeriu algo que de fato encaixa na tarefa.
- ✓Um só cartão; a segunda tarefa não gerou outro.
- ✓Explicou em uma linha por que ajudaria, e deixou você decidir.
✗ Falhou
- ✗Sugeriu algo genérico que não tem relação.
- ✗Insistiu com mais de um cartão.
- ✗Instalou ou ativou algo sem você escolher.
💡 Se você usa o Claude Code
A mesma lógica vale para skills locais. Pergunte "há alguma skill instalada que cobre isso?" e veja se ele lista as suas em vez de inventar.
5️⃣ Teste 5: Controle
Este teste tem dois caminhos: pela interface (configurações de memória) e pela conversa (pedindo ao Claude para apagar). Faça os dois e compare.
Caminho 1: pela interface
Abra as configurações de memória
Web ou celular
Procure a área que lista o que está guardado sobre você. O caminho exato varia entre superfícies; o prompt capturado orienta o Claude a não adivinhar o menu.
Escolha um item e remova
Algo inofensivo
Por exemplo, uma preferência de formatação. Anote o texto exato antes de apagar.
Confirme em conversa nova
A prova é o comportamento
Pergunte o que ele lembra sobre aquele assunto. O item não deve aparecer.
Copie e rode
Caminho 2: pela conversa
Apague da sua memória o registro sobre <item inofensivo, ex.: minha preferência por listas numeradas>. Confirme o que foi removido.
⚠️ Diferença que vale anotar
Se pela interface funciona e pela conversa não (ou vice-versa), isso é uma informação sobre o produto na sua superfície. Registre os dois resultados separadamente na ficha.
🏁 Fechar a ficha dos cinco testes
Você tem cinco fichas. Agora consolide numa tabela só. Este é o resultado que vale: o produto na sua conta, nas suas condições, na sua data.
| Teste | Grupo de ferramentas | Resultado | Uma frase |
|---|---|---|---|
| 1. Continuidade | Memória (6) | [passou / parcial / falhou] | [o que viu] |
| 2. Registro | Conversas passadas (3) | [passou / parcial / falhou] | [o que viu] |
| 3. Interface | Respostas visuais (13) | [passou / parcial / não disponível] | [o que viu] |
| 4. Capacidade | Plugins + skills (4) | [passou / parcial / falhou] | [o que viu] |
| 5. Controle | Memória + configurações | [passou / parcial / falhou] | [o que viu] |
Copie e rode
Modelo de veredito final (uma frase, com contexto)
Veredito — Fable 5.1 no <web / celular / Claude Code>, plano <X>, em <data>:
<passou N de 5>. Memória e registro funcionaram; visual não disponível neste plano; controle funcionou pela interface e falhou pela conversa.
Sem afirmar nada sobre o modelo: isto avalia o produto na minha conta.
✓ Veredito bem escrito
- ✓Diz superfície, plano e data.
- ✓Separa produto de modelo.
- ✓Nomeia o que não estava disponível como informação, não como defeito.
✗ Veredito fraco
- ✗"Funcionou bem no geral."
- ✗"O Fable 5.1 é melhor que o anterior." (não foi isso que você mediu)
- ✗Sem data.
🧪 Teste rápido do módulo
Três perguntas. Clique numa opção para ver a resposta.
1. No Teste 2, o Claude respondeu "não tenho acesso a conversas anteriores" sem buscar. Segundo o prompt capturado, isso é:
2. No Teste 3, você pediu "qual a apresentação mais útil" sem dizer "gráfico" e veio prosa. Isso é:
3. No Teste 4, ele sugeriu uma skill e, na tarefa seguinte da mesma conversa, sugeriu outra. Veredito?
📋 Resumo do módulo
Próximo módulo:
2.3 - Escrever para o Fable e usar o Claude Code