TRILHA 4

🎛️ Configurar e estender

Deixe o Jarvis com a sua cara: interruptores que param o que está em voo, modos de fila, persona em três camadas, custo do prompt, agentes e skills, tiers de custo, gestor do Ollama e o que ainda não foi feito.

2
Módulos
12
Tópicos
150 min
Duração
Configuração
Nível
Progresso da trilha 4 0%
0 de 0
prefs (banco) por chat, sobrevive a restart arquivos do repo agents, skills, config /parar · /retomar /fila · /personality agent.yaml · SKILL.md ollama · precos execução Ollama ou claude -p

Legenda: o que você muda no chat (coluna da esquerda, de cima) vai para a tabela prefs e vale só naquele chat. O que você muda em arquivo (de baixo) vale para o sistema todo e quase sempre pede restart. As duas colunas terminam no mesmo lugar: a resposta que sai.

Mapa da trilha

Conteúdo detalhado

4.1 ~70 min

🎛️ Controle da conversa

Parar, priorizar e dar voz: interruptores que cancelam o que está em voo, os quatro modos de fila com os limites honestos, persona em três camadas, custo fixo do prompt, MCP por agente e onde consultar a sintaxe.

Progresso do módulo 4.1 0%
0 de 0
O que é:

/parar [tudo|agentes|<agente>] [motivo] liga um interruptor que fica gravado na tabela prefs e sobrevive a restart. /retomar desliga. Ligar cancela o que está em voo nas lanes chat, agente e io que bate com o alvo.

Por que aprender:

É o freio de mão. Quando um agente começa a fazer besteira, /parar agentes segura o despacho sem derrubar o serviço nem perder o histórico da fila.

Conceitos-chave:

prefs · alvo tudo, agentes, agente:id · lane ollama segue livre · até 30 s para o processo morrer

O que é:

/fila collect|followup|steer|interrupt define, por chat, o que fazer com uma mensagem que chega enquanto outra está em curso. O padrão é collect: junta mensagens seguidas por 2 s e responde uma vez.

Por que aprender:

Dois dos quatro modos têm limite honesto frente ao openclaw: steer não injeta no agente em execução e interrupt descarta a resposta direta em voo em vez de abortar.

Conceitos-chave:

janela de 2 s · prioridade alta · flow_ref canal:chat · contador de geração

O que é:

O prompt soma sempre nesta ordem: IDENTIDADE.md na raiz (a base, nunca sai), agents/<id>/SOUL.md (persona fixa do agente) e personalidades/<nome>.md, escolhida por chat com /personality <nome>.

Por que aprender:

Criar uma voz nova é criar um arquivo .md. Saber qual camada manda evita a briga entre uma regra da identidade e um pedido da personalidade.

Conceitos-chave:

IDENTIDADE.md · SOUL.md pede restart · curto e professor · trocar apaga a sessão retomada

O que é:

/context [detail] [texto] conta os tokens de cada camada do prompt (identidade, persona, USER.md, memória e insights, histórico, skills, regras, mensagem), para a resposta direta e para o agente, sem chamar modelo de chat.

Por que aprender:

Overhead fixo é o que você paga em toda mensagem. Medir mostra qual camada cresceu antes de você sair cortando memória boa.

Conceitos-chave:

camadas do prompt · detail lista os itens · retrieval só leitura · saliência intacta

O que é:

A chave mcp_config: mcp.json no agents/<id>/agent.yaml faz o claude -p subir com --mcp-config <arquivo> --strict-mcp-config. O agente enxerga só os servidores daquele arquivo.

Por que aprender:

Sem a chave, o agente herda todos os MCP do seu ~/.claude. Com ela, um especialista de pesquisa não ganha por acidente uma ferramenta que escreve.

Conceitos-chave:

MCP · caminho relativo à pasta do agente · mcp.json.example · strict

O que é:

/ajuda lista os comandos por grupo, incluindo o bloco "Controle da conversa". /ajuda <comando> abre o detalhe de parar, retomar, fila, personality e context.

Por que aprender:

Esses cinco comandos nasceram na versão 3.2.1 e foram corrigidos na 3.2.2. O CHANGELOG diz o que mudou e a seção 9b do README diz como funciona hoje.

Conceitos-chave:

3.2.1 fase 9 · 3.2.2 interrupt em voo · 3.2.3 documentação · README seção 9b

Ver Completo
4.2 ~75 min

🧩 Agentes, skills, custo e o que vem

Estenda sem quebrar: um agente é uma pasta, uma skill é um arquivo, o custo tem tier e trava, o Ollama tem preflight, os canais extras estão desligados de propósito e o roadmap só anda com ordem.

Progresso do módulo 4.2 0%
0 de 0
O que é:

Cada pasta em agents/ com um agent.yaml vira um agente. O model é reduzido a um alias da CLI (opus, sonnet, haiku, fable), e effort, read_only e cwd completam o registro. O prompt vem do CLAUDE.md da pasta.

Por que aprender:

O desenho é N especialistas só leitura em paralelo mais um lead com escrita. Errar o read_only é dar caneta a quem devia só pesquisar.

Conceitos-chave:

agents/comms, content, ops, research · lead sonnet · pasta com _ é ignorada · restart para reler

O que é:

Uma skill é um skills/<id>/SKILL.md com name e description no cabeçalho. Só esses dois campos entram no prompt; o corpo é lido sob demanda por quem executa. /skills lista o que está instalado.

Por que aprender:

Quinze skills vieram do v2 como estão. Como só a descrição custa tokens, a descrição é a parte que precisa estar boa: é ela que faz a skill ser escolhida.

Conceitos-chave:

front matter · skills/_rascunhos · loop de aprendizado · decisão 6 do plano

O que é:

Toda chamada de modelo passa por src/custo/gateway.ts, inclusive embeddings. Três tiers: local no Ollama com custo zero, barato no haiku e premium para a rota de agente. config/precos.yaml tem o USD por 1M de tokens.

Por que aprender:

O orçamento em config/orcamento.yaml avisa em 70 % e trava em 100 %, quando só o Ollama passa. Saber disso evita o susto de "o bot parou de chamar agente".

Conceitos-chave:

chamadas_llm · ORCAMENTO_MENSAL_USD · /usage por tier e por agente · motivo do upgrade registrado

O que é:

config/ollama.yaml dá um modelo a cada papel: roteador em llama3.2, geral em qwen3.8:27b residente, embed em bge-m3 e pesado desligado. O preflight checa RAM antes de cada chamada local.

Por que aprender:

São as mesmas tags do v2 de propósito: um único modelo grande serve os dois bots. Trocar a tag do geral sem trocar no v2 põe dois modelões na memória.

Conceitos-chave:

piso_ram_gb 40 · descarregar_alheios false · keep_alive -1 · /ollama preflight

O que é:

Slack tem cliente e probe de OAuth no doctor, mas fica desligado até o corte porque o token é do v2. WhatsApp é um stub que recusa enquanto o v2 é dono da sessão do número. O canal HTTP aceita POST /mensagem.

Por que aprender:

Esses desligamentos não são bug: são a regra da coexistência. E o HTTP dispara agente com permissões, então expor na rede exige as duas variáveis certas.

Conceitos-chave:

SLACK_ENABLED e WHATSAPP_ENABLED em 0 · HTTP_BIND_V3 · DASHBOARD_TOKEN_V3 · dashboard só leitura

O que é:

A fase 8 é o corte: trocar o token de produção, deixar o v2 só leitura por 30 dias e arquivar. A fase 10 está anotada em docs/INCORPORAR-V3.md: cliente MCP nativo no caminho Ollama, servidor MCP do inemavox e voz no Telegram.

Por que aprender:

Saber o que ainda não existe evita procurar botão que não tem. A lista do que falta está na seção 15 do README, escrita pelo próprio projeto.

Conceitos-chave:

paridade antes do corte · fase 11 Jarvis aprende · Hermes e openclaw como fontes · steer sem injeção

Ver Completo
Trilha anterior Voltar ao curso