🧱 APP · RESULTADO · ESCOPO · PROVA
O guia de campo resume o que faz um prompt de computer use funcionar em quatro linhas. APP: nomeie o app, workspace ou navegador exato. RESULTADO: descreva a coisa útil que você quer no fim. ESCOPO: diga quais arquivos ou configurações podem mudar. PROVA: diga como o agente deve verificar que terminou.
| Parte | Como aparece no prompt 04 (edição de vídeo) | O que acontece se faltar |
|---|---|---|
| APP | Descript, instalado e autenticado; Drive opcional | O agente escolhe outro editor ou abre o navegador |
| RESULTADO | Arquivo exportado no novo nome, na resolução da fonte | Ele "limpa" e não exporta, ou exporta em 720p |
| ESCOPO | Preservar o original; criar projeto novo; não enviar a ninguém | O original é sobrescrito |
| PROVA | O exportado decodifica, tem imagem e som, duração comparada sem tratar "mais curto" como "melhor" | Você recebe "pronto" e descobre o problema ao abrir o arquivo |
🔤 Marcadores: o que você troca e o que preserva
Os prompts do kit vêm em arquivos de texto separados justamente para copiar sem perder nada. A regra é mecânica: tudo que está entre < e > é seu para preencher; o resto é o contrato e fica como está até você entender por que cada frase existe.
| Tipo de marcador | Exemplos nos prompts | Como preencher |
|---|---|---|
| Entrada | <ORIGIN_AIRPORT>, <SOURCE_VIDEO_PATH>, <REPO_PATH> | Caminho ou valor exato. Datas com ano completo. Nada relativo como "amanhã". |
| Destino | <OUTPUT_FOLDER>, <FOLDER_URL_OR_NONE> | Pasta nova e vazia por execução. "NONE" é resposta válida e evita upload indesejado. |
| Conta e app | <APP_AND_WORKSPACE>, <ACCOUNT_HANDLE> | Nome exato do app e o identificador visível da conta. O agente confirma na tela antes de agir. |
| Critério | <EXPECTED_RESULT>, <OBSERVABLE_PASS_CONDITIONS> | Condição que dá para ver: "a resposta cita o título e o link da aula", não "funciona bem". |
| Orçamento | <SEARCH_BUDGET>, <TIME_OR_ATTEMPT_LIMIT>, "três tentativas de reparo" | Número. É o freio do agente autônomo: sem ele, uma falha vira uma noite de tentativas. |
✓ Preserve sem mexer
- ✓"Search only; do not book" e equivalentes: são os limites de dano.
- ✓"Stop at any login or secret entry that needs me."
- ✓"Do not invent timing breakdowns" e "missing data must not become zero".
- ✓As instruções de comparar com a tela ou com a fonte antes de reportar.
✗ Erros de preenchimento comuns
- ✗Deixar
<YYYY-MM-DD>no prompt: o agente escolhe uma data. - ✗Usar uma pasta de saída já cheia: capturas antigas se misturam às novas.
- ✗Escrever o critério como adjetivo ("rápido", "bom").
- ✗Apagar a linha de orçamento porque "quero que ele termine".
💡 Regra prática
Antes de colar, procure o sinal de menor no seu prompt final. Se ainda houver algum, você não terminou de preencher. Depois, leia as frases que começam com "Do not" e confirme que todas continuam lá.
✅ Prova de conclusão não é screenshot
O guia é explícito num ponto que a maioria dos tutoriais ignora: "uma captura de tela ou um nome de arquivo sozinho não prova conclusão". Cada fluxo define a própria prova, mas todas cabem em três famílias: o artefato funciona, o estado persiste e a afirmação bate com a fonte.
O artefato funciona
Fluxo 04: o vídeo exportado precisa decodificar, conter imagem e som e estar na resolução da fonte. Fluxo 01: o JSON exportado tem os campos preenchidos, e o que falta está marcado "unknown", nunca zero.
O estado persiste
Fluxo 05: sair da tela de configurações, reabrir e ver o mesmo valor. Fluxo 03: fechar e reabrir a conversa do app e confirmar que o contexto sobreviveu.
Bate com a fonte
Fluxo 02: uma resposta material do MCP conferida contra a fonte de onde veio. Fluxo 01: ao menos uma tarifa exportada comparada com o que está visível na página.
⚠️ A frase que parece prova e não é
"Comparei a duração: a edição ficou 3 minutos mais curta." O prompt 04 manda reportar a duração antes e depois "sem tratar uma edição mais curta como prova de qualidade". Cortar demais também encurta. A prova é ouvir os cortes e confirmar que o conteúdo único sobreviveu.
🧱 O bloqueio exato com evidência
Os cinco prompts repetem a mesma instrução com palavras diferentes: "stop with the exact blocker", "stop at that screen and tell me the exact action needed", "return the evidence and next diagnostic step". O bloqueio não é falha do fluxo. É uma das saídas previstas.
Anatomia de um bloqueio bem reportado
Onde parou
A tela, janela ou etapa exata. "Na tela de login do Descript" e não "não consegui abrir".
O que falta
A condição ausente: credencial, controle que não existe nesta versão do app, ferramenta não habilitada na sessão, arquivo que não decodifica.
Evidência
A captura daquela tela ou a mensagem de erro literal. Aqui a captura serve: ela documenta o bloqueio, não prova conclusão.
A ação de quem opera
O que você precisa fazer para destravar: fazer login, abrir o espelhamento, habilitar a ferramenta, fornecer o caminho certo.
O que já está feito e o que não foi tocado
Separar concluído, já-correto e bloqueado, como o prompt 05 exige. Nada fica ambíguo.
✓ Bloqueio bem reportado
- ✓"O controle Upload at highest quality não existe nesta versão do app. Captura anexa. Os outros dois ajustes foram aplicados e verificados."
- ✓"O arquivo não decodifica (erro do ffprobe colado). Original preservado. Nada foi exportado."
- ✓"A sessão não tem o navegador interno habilitado. Plano gerado, busca não executada."
✗ Falso progresso
- ✗"Não achei o controle, mas provavelmente já está ativado."
- ✗"Exportei, deve estar na pasta."
- ✗"Fiz a busca de memória: o voo mais barato costuma ser da Air Canada."
💡 Peça isso por escrito
Inclua no seu prompt a frase "se algo bloquear, pare naquela tela e me diga a ação exata necessária; separe concluído, já-correto e bloqueado". É a linha que transforma uma sessão perdida numa lista de pendências.
🔁 O modelo reutilizável para qualquer trabalho
O kit fecha com um prompt curto para qualquer tarefa que não seja um dos cinco fluxos. Ele é o contrato de quatro partes em forma de formulário. Abaixo, traduzido e com os marcadores preservados.
Copie e rode
Rodar uma tarefa de computer use qualquer com app, escopo, sucesso e orçamento explícitos (Codex com a ferramenta de computer use habilitada)
Use <APP_OU_NAVEGADOR_EXATO> para concluir <RESULTADO_OBSERVAVEL>.
Entradas: <ARQUIVOS, ENDERECOS, CONTA_OU_WORKSPACE>
Escopo: <O_QUE_PODE_MUDAR>
Sucesso: <VERIFICACOES_VISIVEIS_DE_ACEITE>
Entregáveis: <ARQUIVOS_E_RELATORIO>
Orçamento: <LIMITE_DE_TEMPO_OU_TENTATIVAS>
Inspecione o estado atual e a documentação ativa da ferramenta antes de agir. Use as capacidades do próprio app quando for isso que estamos testando. Mantenha o material de origem e o trabalho não relacionado intactos. Tome decisões razoáveis dentro do escopo pedido; pergunte só o que faltar e mudar materialmente o resultado.
Depois do trabalho, verifique o resultado na interface ou no artefato exportado. Se falhar, reproduza o problema e devolva a evidência. Reporte o que foi concluído, o que ficou sem verificar e o próximo passo exato.
💡 Exemplo preenchido
App: o navegador interno do Codex. Resultado: a lista de todos os cursos publicados em inema.club com título e link, exportada em CSV. Entradas: a URL da home. Escopo: nada muda no site, só leitura. Sucesso: o CSV tem ao menos 200 linhas e 3 títulos escolhidos por mim aparecem nele. Entregáveis: o CSV e uma captura da última página visitada. Orçamento: 15 minutos.
🔧 "Make it yours": adaptar cada fluxo ao seu caso
Cada página do guia termina com um parágrafo "make it yours". Juntos, eles formam a regra de adaptação: troque o app e a condição de sucesso, preserve as checagens de evidência.
| Fluxo | Troque | Preserve | Variação sugerida pelo guia |
|---|---|---|---|
| 01 Busca vira ferramenta | O site e as entradas da busca | Inspecionar a interface uma vez, salvar uma rota suportada, verificar cada resultado | Qualquer busca repetida: imóveis, peças, vagas |
| 02 Testar dentro do app | O app hospedeiro e a condição de sucesso | Inspecionar a chamada da ferramenta, follow-ups, caso sem resultado, conferência com a fonte | MCP, recurso por API, skill ou plugin |
| 03 Um agente testa outro | A tarefa de navegador por uma jornada de usuário concreta | O app faz as próprias ações; falha registrada; reparo passa no mesmo teste | App sem agente: criar rascunho, salvar, reabrir |
| 04 Entrega da edição | O vídeo e o destino | Estabilidade do arquivo, decodificação, original intacto | Render não terminado: pedir acompanhamento agendado |
| 05 Celular pelo computador | O app móvel, a conta e a configuração alvo | Antes/depois e verificação de persistência | Qualquer app que só existe no celular |
Copie e rode
Adaptar o fluxo 02 para testar uma skill sua no Claude Code, mantendo as checagens de evidência (Codex com computer use e o Claude Code instalado)
Use computer use para testar minha skill existente dentro do app real.
App hospedeiro e workspace: Claude Code, na pasta <CAMINHO_DO_PROJETO>
Ferramenta / skill: /<NOME_DA_SKILL>
Tema seguro de teste: <TEMA_SEM_DADOS_PRIVADOS>
Resultado esperado: <O_QUE_A_SKILL_DEVE_PRODUZIR, VISIVEL>
Código-fonte opcional: <CAMINHO_DA_SKILL_OU_NONE>
Confirme que está no app e na pasta certos. Verifique se a skill aparece. Não reinstale nem reescreva o que já existe.
Rode um pedido realista e só de leitura. Inspecione as chamadas de ferramenta, não só a resposta final. Faça dois follow-ups naturais que dependam da primeira resposta. Inclua um caso sem resultado para ver se ela admite incerteza.
Confira uma afirmação material contra a fonte. Registre entradas, saída, erros e tempo decorrido; separe tempo do modelo e tempo da ferramenta só quando a evidência permitir.
Devolva: checagens que passaram, falhas reproduzidas, evidência e a correção de maior valor. Se houver código, aponte o local provável sem alterar nada. Não envie mensagens a ninguém.
💡 Teste de estrutura
Se ao adaptar um prompt você apagou uma frase que começa com "verify", "confirm", "compare" ou "do not", pare. Essas são as checagens de evidência. O guia manda preservá-las em todas as variações.
🧪 Teste rápido do módulo
Três perguntas. Clique numa opção para ver a resposta.
1. Qual das quatro partes do contrato está faltando em "Abra o Descript e limpe o meu vídeo da pasta Vídeos"?
2. O agente reportou: "exportei o vídeo, ele ficou 3 minutos mais curto, sucesso". O que está errado?
3. Ao adaptar o fluxo 02 para testar um plugin, o que você preserva obrigatoriamente?