Crie a sua KATIA
O guia pra montar o seu próprio agente autônomo, do jeito que eu montei a KATIA, a assistente do Colaboratório: peça aberta, rodando no seu WhatsApp, começando pelo seu computador e terminando numa VPS ligada 24 horas.
#Quem escreve
Eu sou o Alexandre Leite. Trabalho com produto há mais de 15 anos: fui o primeiro PM da Nibo, passei de PM a GPM no eBay, na Farfetch e na Kaizen Gaming (Betano), fui product builder de duas startups americanas e hoje toco o Colaboratório, um estúdio de produto digital no Porto que atende Brasil, Portugal e fora.
Não sou programador nato. Vim de negócio e produto, e foi aí que a IA virou meu acelerador, não minha identidade. A KATIA nasceu assim: eu precisava apagar as fricções da minha própria operação, montei com peça de código aberto e hoje ela roda o Colaboratório todo dia e já trabalha pra clientes.
Este guia é o caminho que eu fiz, com o que funcionou e o que quebrou no meio. Ficou mais fácil montar um agente desses, mas continua sendo trabalho. A promessa aqui não é resultado mágico: é você saber onde colocar energia e como medir se está dando samba.
#Antes de começar: escolhe a fricção que te atrapalha

Seu primeiro agente não vai fazer tudo por você. E nem deveria. Ele começa apagando uma fricção: aquele atrito pequeno entre decidir e fazer, que ninguém vê porque virou hábito.
Sem escolher qual, o que você monta é só um chatbot no seu WhatsApp.
As fricções que a KATIA apagou primeiro aqui no Colaboratório:
- O áudio de 4 minutos que eu precisava ouvir pra saber se era urgente.
- O pedido que sumia no grupo do cliente no meio da conversa.
- A reunião que acabava sem ninguém anotar quem faz o quê.
- O dia que começava caçando pendência em cinco lugares.
- Copiou alguma coisa de um lugar pro outro.
- Conferiu duas vezes a mesma informação.
- Deixou algo pra depois porque dava preguiça de abrir outro app.
No fim do dia, escolhe uma. A que mais se repete ou a que mais dói. É ela que o seu agente vai apagar primeiro. Mede quanto tempo ela te come hoje: sem esse número, você não vai saber se deu samba.
#As quatro camadas

Todo agente autônomo que presta tem as mesmas quatro peças. O modelo é a que mais muda (sai um melhor todo mês); a memória é a que fica. Se você entender isso, já entendeu o jogo.
A mensagem chega por um canal que você já usa, o harness decide o que fazer com ela, consulta a memória, chama o modelo e grava o resultado no sistema onde o trabalho termina. As rotinas fazem esse ciclo rodar sozinho, sem ninguém mandar mensagem.
#Camada 1: harness, o corpo

O harness é o programa que transforma um modelo que só conversa num agente que age. Ele dá ao modelo canal (WhatsApp, Telegram, Slack), ferramentas, memória e agenda. Hoje os dois mais usados são abertos e gratuitos: OpenClaw e Hermes Agent.
Eu usei os dois. A KATIA nasceu no OpenClaw e hoje roda no Hermes.
| OpenClaw | Hermes Agent | |
|---|---|---|
| Quem faz | Comunidade open source (MIT) | Nous Research (MIT) |
| Linguagem | TypeScript (Node) | Python |
| Memória nativa | Transcrição por sessão, compacta quando enche | Banco pesquisável entre sessões, cria skills a partir do uso |
| Canais | WhatsApp, Telegram, Slack, Discord, Signal e vários outros | WhatsApp, Telegram, Slack, Discord, Signal, e-mail |
| Arquivos | Trabalha numa pasta cercada, com aprovação humana | Trabalha direto na pasta onde roda |
| Perfis | Um agente principal, com subagentes | Perfis isolados: várias instâncias, cada uma com seu cérebro |
| Bom pra | Começar rápido e com mais trava | Memória forte, perfis separados, rodar em servidor |
Qual escolher? Se é sua primeira vez, tanto faz: escolhe um e aprende o conceito. O que você aprender aqui vale pro outro. Eu migrei pro Hermes quando precisei de uma instância por cliente, cada uma com memória, persona e travas próprias.
#Instalando no seu computador
Mac, Linux ou Windows com WSL2. Abre o terminal e roda um dos dois.
OpenClaw (repositório · documentação):
curl -fsSL https://openclaw.ai/install.sh | bashO instalador já cuida do Node. No fim, ele abre o assistente de configuração: escolhe o provedor de modelo, cola sua chave de API e ele testa a conexão. O painel abre sozinho no navegador.
Hermes (repositório · documentação):
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
source ~/.bashrc
hermes setupO hermes setup é o assistente completo. Se quiser só escolher o modelo, hermes model. Depois, hermes abre a conversa no terminal.
#Primeiro teste: conversa com ele
Antes de ligar qualquer canal, conversa no terminal. Pede pra ele se apresentar, pergunta o que ele consegue fazer, manda uma tarefa simples ("cria um arquivo com a lista das minhas tarefas de hoje"). Se funcionou aqui, o resto é encanamento.
#Ligando um canal
Comece pelo Telegram: é o mais simples e não tem risco de bloqueio. Você cria um bot com o @BotFather, pega o token e cola no assistente do harness.
- OpenClaw: o assistente de configuração pergunta os canais; a documentação tem um guia por canal.
- Hermes:
hermes gateway setupconfigura os canais ehermes gateway startliga.
#Camada 2: modelos, o motor

O modelo é quem pensa e age. É também onde mora a conta: um agente que roda o dia inteiro, com rotina a cada 30 minutos, faz muito mais chamada do que você conversando no chat. Escolher bem o modelo e o provedor é a diferença entre um custo viável e um proibitivo.
A regra que eu uso: um modelo principal barato pro volume do dia a dia, e os grandes só quando a tarefa pede.
| Papel | O que eu uso na KATIA | Pra quê |
|---|---|---|
| Principal | OpenCode, com acesso a DeepSeek, GLM e aos modelos mais capazes e em conta | Triagem, resumo de áudio, transformar pedido em tarefa, rotinas |
| Pesado | OpenAI e Anthropic | Raciocínio longo, texto que vai pra cliente, decisão delicada |
| Reserva | Uma cadeia de modelos em sequência | Se o principal cai, o próximo assume e o agente não para |
Por que não usar só o melhor modelo? Porque a maior parte do que um agente faz é trabalho simples e repetitivo. Pagar preço de modelo de ponta pra classificar mensagem de grupo é queimar dinheiro.
Por que não ficar preso a um fabricante? Porque sai modelo melhor todo mês. Quando a memória mora fora do modelo (próxima camada), trocar de motor é mudar uma linha de configuração, e não recomeçar do zero.
#Como começar
- No assistente de configuração do harness, escolhe um provedor e cola a chave de API. Pra primeira semana, qualquer um serve.
- Coloca um limite de gasto mensal no painel do provedor. Sempre. Agente com rotina e sem limite é fatura surpresa.
- Depois de uma semana rodando, olha onde foi o gasto. Move o que for repetitivo pro modelo barato e deixa o caro só pro que precisa.
#Camada 3: memória, o cérebro

Sem memória, todo agente acorda do zero. Você explica quem é o cliente, o que foi combinado, qual é o projeto. Toda vez. É a camada que os grandes vendem como caixa-preta, e é onde a KATIA mais se diferencia: a memória é aberta, fica fora do modelo e é minha.
A memória da KATIA tem três níveis:
- Memória de trabalho. O que o agente anota de cada conversa e de cada dia. Vem pronta no harness.
- Consolidação. Uma rotina que, de tempos em tempos, relê o que foi anotado, promove o que importa e descarta o resto. Sem isso, a memória vira um caderno de rascunho infinito.
- Second brain. Um cofre no Obsidian com projetos, pessoas, reuniões, decisões e protocolos. Ele se alimenta sozinho: os monitores escrevem as demandas e os contatos novos, as reuniões viram nota, as sessões de trabalho viram resumo.
O modelo por trás: o LLM Wiki do Karpathy. O second brain da KATIA segue o padrão que o Andrej Karpathy descreveu num gist em 2026: em vez de você organizar as anotações, a IA organiza. São três peças:
- Material bruto (
raw/): tudo que chega, do jeito que chega. Transcrição de reunião, áudio, link salvo, conversa de grupo. - Wiki compilada (
wiki/): páginas limpas por assunto (cliente, projeto, pessoa, decisão), com links entre elas. Quem escreve é a IA; nas palavras dele, você raramente edita a wiki na mão. - Regras (um arquivo como
CLAUDE.mdouAGENTS.md): como a IA deve organizar, nomear e ligar as páginas.
E três operações que viram rotina: ingerir (ler o bruto e atualizar a wiki), consultar (responder usando só a wiki, citando a fonte) e revisar (achar link quebrado, página órfã e informação contraditória). O cofre do Colaboratório funciona exatamente assim: os monitores despejam no bruto e a consolidação compila na wiki.
Por que isso importa tanto. O cofre é só uma pasta de arquivos de texto. Ele fica fora do modelo e fora do harness. Eu troquei de harness (do OpenClaw pro Hermes) e a empresa continuou lembrando de cada cliente e cada decisão. E não é só a KATIA que lê: Claude, ChatGPT, Codex e qualquer outro agente que eu use leem e escrevem no mesmo lugar, via MCP (o padrão que liga ferramentas a IAs).
#Como começar
- Deixa a memória nativa do harness ligada. Na primeira semana, é suficiente.
- Cria um cofre no Obsidian com poucas pastas: projetos, pessoas, reuniões, decisões.
- Conecta o cofre ao agente (o Obsidian tem plugin de API local e existem servidores MCP prontos pra ele).
- Pede pro agente registrar ali tudo que mudar de estado: um cliente novo, uma decisão, um combinado.
Regra de ouro: o que é importante mora em arquivo que você consegue abrir e ler. Se a memória só existe dentro de um produto, ela é do produto, não sua.
#Camada 4: skills, rotinas, e os hábitos

É aqui que o agente deixa de esperar você mandar. Rotina é o que ele faz sozinho, em dois formatos:
- Programadas (cron): hora marcada. "Todo dia às 7h30, me manda o bom dia."
- Reativas (heartbeat e gatilhos): o agente acorda de tempos em tempos, olha o que chegou e decide se tem algo a fazer. "Chegou áudio? Transcreve e me diz se é urgente."
Nos dois harnesses você cria rotina em linguagem natural, conversando com o agente. No Hermes também dá pelo terminal, com hermes cron.
#O que a KATIA roda hoje
| Rotina | Quando | Fricção que apaga |
|---|---|---|
| Bom dia: agenda, e-mails esperando resposta, o que ficou de ontem | Todo dia, 7h30 | Começar o dia caçando pendência |
| Transcrição de áudio, com resumo e urgência | Chegou áudio | Ouvir áudio de 4 minutos |
| Vigia de grupos: pedido no WhatsApp vira tarefa, sem duplicar | A cada 30 minutos | Pedido que some no grupo |
| Reunião vira lista com dono e prazo | Depois de cada call | Ata que ninguém escreve |
| Lead que chega no WhatsApp vira pessoa e oportunidade no CRM | Conversa nova | Lead que esfria |
| Consulta a agenda antes de sugerir horário | Alguém pede reunião | O vai e volta pra marcar |
| Banco de referências: posts salvos viram nota transcrita | Toda madrugada | Salvar e nunca mais achar |
| Consolidação de memória | Recorrente | Contexto que se perde |
#Como começar
Cria uma rotina, a da fricção que você escolheu lá no começo. Escreve do jeito que falaria com alguém da equipe:
Todo dia às 8h, olha minha agenda e meus e-mails e me manda no Telegram: as reuniões do dia, os e-mails que esperam resposta e o que ficou pendente ontem.
Deixa rodar uma semana antes de criar a segunda. Rotina ruim não dá erro: ela só vira barulho, e você para de ler.
#Do computador à VPS: ligado 24 horas

No seu computador, o agente dorme quando a tampa fecha. Rotina das 7h30 com o notebook desligado não acontece. Quando a primeira rotina provar que vale a pena, é hora de subir pra um servidor.
Etapa 1, no computador (uma tarde). Instala o harness, pluga o modelo, conecta o Telegram, cria a primeira rotina. O objetivo é ver funcionar, não deixar perfeito.
Etapa 2, na VPS (quando a rotina provou valor). Uma VPS é um computador alugado na nuvem que nunca desliga. Um plano pequeno dá conta de um agente pessoal. Eu uso Hetzner.
- Cria a VPS com Ubuntu e acessa por SSH.
- Instala o harness com o mesmo comando que você usou no computador.
- Configura igual (modelo, canal, rotinas). Se a memória mora em arquivos, é só levar a pasta junto.
- Deixa rodando como serviço, pra ele voltar sozinho se o servidor reiniciar:
- OpenClaw:
openclaw gateway install - Hermes:
hermes gateway install
- OpenClaw:
- Não expõe nada na internet sem necessidade. Pro painel e pros serviços internos, use um túnel seguro (Cloudflare Tunnel ou Tailscale) em vez de abrir porta.
- Desliga no computador quando a VPS estiver de pé. Duas instâncias no mesmo número de WhatsApp brigam entre si.
#A stack da KATIA

O que roda de verdade por trás da KATIA hoje. Você não precisa de tudo isso pra começar: a coluna da direita diz quando cada peça vale a pena.
| Camada | Peça | Quando entra |
|---|---|---|
| Harness | Hermes Agent (veio do OpenClaw) | Dia 1 |
| Canal | WhatsApp via Baileys, mais Slack e Telegram | Dia 1 (comece pelo Telegram) |
| Modelos | OpenCode como principal (DeepSeek, GLM); OpenAI e Anthropic pro pesado; cadeia de reserva | Dia 1 com um só; o resto quando a conta aparecer |
| Áudio | whisper.cpp, rodando local | Quando áudio for sua fricção |
| Memória | Obsidian como second brain, ligado via MCP | Segunda semana |
| Servidor | VPS na Hetzner | Quando a primeira rotina provar valor |
| Acesso seguro | Cloudflare Tunnel e Tailscale | Junto com a VPS |
| Automação | n8n self-hosted | Quando precisar ligar sistemas que o harness não alcança |
| Tarefas | Linear | Quando o agente começar a criar tarefa |
| CRM | Twenty, aberto e self-hosted | Quando o agente começar a cuidar de lead |
#Onde costuma travar

Vai dar alguma coisa errada, e tá tudo bem. Os tropeços mais comuns:
- Querer que ele faça tudo na primeira semana. Uma fricção, uma rotina. O resto vem depois que a primeira der samba.
- Fatura surpresa. Rotina frequente com modelo caro e sem limite de gasto. Coloca o limite antes de criar a primeira rotina.
- Número de WhatsApp bloqueado. Conexão não oficial tem esse risco. Chip dedicado, sempre.
- Rotina que vira barulho. Se você parou de ler o bom dia, ele não está apagando fricção, está criando. Ajusta ou desliga.
- Memória que ninguém cuida. Sem consolidação, o agente começa a lembrar de coisa velha e errada. Revisa o cofre uma vez por semana no começo.
- Agente com poder demais. Terminal liberado em servidor de produção é pedir pra dar ruim. Libera ferramenta aos poucos.
#Próximos passos

- Faz o exercício da fricção.
- Instala o harness no seu computador e conversa com ele.
- Liga o Telegram e cria a primeira rotina.
- Deixa rodar uma semana e mede: quanto tempo a fricção te comia antes, quanto come agora.
Tenta e me conta se deu samba, ou onde travou.
#Quer que eu monte com você?
Se você chegou até aqui e pensou "quero isso, mas não quero montar sozinho", é exatamente pra isso que o Colaboratório existe. Tem três jeitos de a gente trabalhar junto:
| Jeito | O que é | Pra quem |
|---|---|---|
| Ensino a fazer | Este guia, mais as peças que eu publico toda semana | Quem quer montar e aprender o caminho |
| Faço com você | A gente senta junto, mapeia suas fricções e monta o seu agente na sua máquina ou no seu servidor. Você sai sabendo manter | Quem quer ter o próprio agente e dominar como ele funciona |
| Faço pra você | A KATIA pronta, configurada pro jeito da sua empresa, no WhatsApp ou no Slack, com hospedagem, memória e ajustes inclusos | Quem quer o resultado sem mexer em terminal |
Tudo começa com uma conversa de 30 minutos, sem compromisso. Você me conta onde está a fricção e eu te digo qual dos três faz sentido, inclusive se for só seguir este guia.
Pra me chamar:
- Me manda uma DM no LinkedIn escrevendo KATIA.
- Ou escreve pra contato@colaborato.rio.
- Ou conhece a KATIA em colaborato.rio/katia.
#Fontes
- OpenClaw: documentação e instalação
- OpenClaw: heartbeat
- Hermes Agent: README no GitHub
- Hermes Agent: referência de comandos
- OpenClaw vs Hermes Agent (Firecrawl)
- AI's third era: the rise of persistent AI coworkers, Tara Seshan no Lenny's Podcast
- LLM Wiki, Andrej Karpathy (gist)
- KATIA, a assistente do Colaboratório
