KATIA acenando

Crie a sua KATIA

Autor
Alexandre Leite
Publicado
Tags
Guia práticoAgentes autônomosCódigo aberto
Leitura
15 min

O guia pra montar o seu próprio agente autônomo, do jeito que eu montei a KATIA, a assistente do Colaboratório: peça aberta, rodando no seu WhatsApp, começando pelo seu computador e terminando numa VPS ligada 24 horas.

#Quem escreve

Eu sou o Alexandre Leite. Trabalho com produto há mais de 15 anos: fui o primeiro PM da Nibo, passei de PM a GPM no eBay, na Farfetch e na Kaizen Gaming (Betano), fui product builder de duas startups americanas e hoje toco o Colaboratório, um estúdio de produto digital no Porto que atende Brasil, Portugal e fora.

Não sou programador nato. Vim de negócio e produto, e foi aí que a IA virou meu acelerador, não minha identidade. A KATIA nasceu assim: eu precisava apagar as fricções da minha própria operação, montei com peça de código aberto e hoje ela roda o Colaboratório todo dia e já trabalha pra clientes.

Este guia é o caminho que eu fiz, com o que funcionou e o que quebrou no meio. Ficou mais fácil montar um agente desses, mas continua sendo trabalho. A promessa aqui não é resultado mágico: é você saber onde colocar energia e como medir se está dando samba.

#Antes de começar: escolhe a fricção que te atrapalha

KATIA tirando o dono de baixo da pilha de áudios

Seu primeiro agente não vai fazer tudo por você. E nem deveria. Ele começa apagando uma fricção: aquele atrito pequeno entre decidir e fazer, que ninguém vê porque virou hábito.

Sem escolher qual, o que você monta é só um chatbot no seu WhatsApp.

As fricções que a KATIA apagou primeiro aqui no Colaboratório:

  • O áudio de 4 minutos que eu precisava ouvir pra saber se era urgente.
  • O pedido que sumia no grupo do cliente no meio da conversa.
  • A reunião que acabava sem ninguém anotar quem faz o quê.
  • O dia que começava caçando pendência em cinco lugares.
Exercício de 10 minutos antes de instalar qualquer coisa. Pega um papel e anota, durante um dia normal, toda vez que você:
  1. Copiou alguma coisa de um lugar pro outro.
  2. Conferiu duas vezes a mesma informação.
  3. Deixou algo pra depois porque dava preguiça de abrir outro app.

No fim do dia, escolhe uma. A que mais se repete ou a que mais dói. É ela que o seu agente vai apagar primeiro. Mede quanto tempo ela te come hoje: sem esse número, você não vai saber se deu samba.

#As quatro camadas

KATIA na mesa, com uma mão pra cada tarefa

Todo agente autônomo que presta tem as mesmas quatro peças. O modelo é a que mais muda (sai um melhor todo mês); a memória é a que fica. Se você entender isso, já entendeu o jogo.

O harness orquestra tudo, e a memória é a peça que ficaCanais: WhatsApp, Slack, Telegram1. Harness, o corpoRecebe as mensagens, chama o modelo, lê e grava a memória, dispara as rotinas2. Modelos, o motorQuem pensa e agePrincipal barato no dia a diaPesado só quando precisaTrocável a qualquer hora3. Memória, o cérebroFica fora do modeloSecond brain em ObsidianCompartilhada com outras IAsTroca o motor, nada se perde4. Rotinas, o hábitoHeartbeat e cronProgramadas e reativasAgem sem você pedirSem elas, é só um chatbotOnde o trabalho termina: CRM, tarefas, e-mail, agenda
As quatro camadas de um agente autônomo

A mensagem chega por um canal que você já usa, o harness decide o que fazer com ela, consulta a memória, chama o modelo e grava o resultado no sistema onde o trabalho termina. As rotinas fazem esse ciclo rodar sozinho, sem ninguém mandar mensagem.

#Camada 1: harness, o corpo

KATIA na mesa telefônica, ligando canais e ferramentas

O harness é o programa que transforma um modelo que só conversa num agente que age. Ele dá ao modelo canal (WhatsApp, Telegram, Slack), ferramentas, memória e agenda. Hoje os dois mais usados são abertos e gratuitos: OpenClaw e Hermes Agent.

Eu usei os dois. A KATIA nasceu no OpenClaw e hoje roda no Hermes.

OpenClawHermes Agent
Quem fazComunidade open source (MIT)Nous Research (MIT)
LinguagemTypeScript (Node)Python
Memória nativaTranscrição por sessão, compacta quando encheBanco pesquisável entre sessões, cria skills a partir do uso
CanaisWhatsApp, Telegram, Slack, Discord, Signal e vários outrosWhatsApp, Telegram, Slack, Discord, Signal, e-mail
ArquivosTrabalha numa pasta cercada, com aprovação humanaTrabalha direto na pasta onde roda
PerfisUm agente principal, com subagentesPerfis isolados: várias instâncias, cada uma com seu cérebro
Bom praComeçar rápido e com mais travaMemória forte, perfis separados, rodar em servidor

Qual escolher? Se é sua primeira vez, tanto faz: escolhe um e aprende o conceito. O que você aprender aqui vale pro outro. Eu migrei pro Hermes quando precisei de uma instância por cliente, cada uma com memória, persona e travas próprias.

#Instalando no seu computador

Mac, Linux ou Windows com WSL2. Abre o terminal e roda um dos dois.

OpenClaw (repositório · documentação):

Bash
curl -fsSL https://openclaw.ai/install.sh | bash

O instalador já cuida do Node. No fim, ele abre o assistente de configuração: escolhe o provedor de modelo, cola sua chave de API e ele testa a conexão. O painel abre sozinho no navegador.

Hermes (repositório · documentação):

Bash
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
source ~/.bashrc
hermes setup

O hermes setup é o assistente completo. Se quiser só escolher o modelo, hermes model. Depois, hermes abre a conversa no terminal.

#Primeiro teste: conversa com ele

Antes de ligar qualquer canal, conversa no terminal. Pede pra ele se apresentar, pergunta o que ele consegue fazer, manda uma tarefa simples ("cria um arquivo com a lista das minhas tarefas de hoje"). Se funcionou aqui, o resto é encanamento.

#Ligando um canal

Comece pelo Telegram: é o mais simples e não tem risco de bloqueio. Você cria um bot com o @BotFather, pega o token e cola no assistente do harness.

  • OpenClaw: o assistente de configuração pergunta os canais; a documentação tem um guia por canal.
  • Hermes: hermes gateway setup configura os canais e hermes gateway start liga.
Aviso sobre o WhatsApp. A KATIA roda no WhatsApp via Baileys, uma conexão não oficial (o mesmo esquema do WhatsApp Web). Funciona muito bem, mas a Meta pode bloquear o número. Use um chip dedicado, nunca o seu número principal. Pra operação de cliente, avalie a API oficial do WhatsApp Business.

#Camada 2: modelos, o motor

KATIA trocando o motor com um guincho

O modelo é quem pensa e age. É também onde mora a conta: um agente que roda o dia inteiro, com rotina a cada 30 minutos, faz muito mais chamada do que você conversando no chat. Escolher bem o modelo e o provedor é a diferença entre um custo viável e um proibitivo.

A regra que eu uso: um modelo principal barato pro volume do dia a dia, e os grandes só quando a tarefa pede.

PapelO que eu uso na KATIAPra quê
PrincipalOpenCode, com acesso a DeepSeek, GLM e aos modelos mais capazes e em contaTriagem, resumo de áudio, transformar pedido em tarefa, rotinas
PesadoOpenAI e AnthropicRaciocínio longo, texto que vai pra cliente, decisão delicada
ReservaUma cadeia de modelos em sequênciaSe o principal cai, o próximo assume e o agente não para

Por que não usar só o melhor modelo? Porque a maior parte do que um agente faz é trabalho simples e repetitivo. Pagar preço de modelo de ponta pra classificar mensagem de grupo é queimar dinheiro.

Por que não ficar preso a um fabricante? Porque sai modelo melhor todo mês. Quando a memória mora fora do modelo (próxima camada), trocar de motor é mudar uma linha de configuração, e não recomeçar do zero.

#Como começar

  1. No assistente de configuração do harness, escolhe um provedor e cola a chave de API. Pra primeira semana, qualquer um serve.
  2. Coloca um limite de gasto mensal no painel do provedor. Sempre. Agente com rotina e sem limite é fatura surpresa.
  3. Depois de uma semana rodando, olha onde foi o gasto. Move o que for repetitivo pro modelo barato e deixa o caro só pro que precisa.

#Camada 3: memória, o cérebro

KATIA transformando a pilha de papéis soltos numa estante organizada

Sem memória, todo agente acorda do zero. Você explica quem é o cliente, o que foi combinado, qual é o projeto. Toda vez. É a camada que os grandes vendem como caixa-preta, e é onde a KATIA mais se diferencia: a memória é aberta, fica fora do modelo e é minha.

A memória da KATIA tem três níveis:

  1. Memória de trabalho. O que o agente anota de cada conversa e de cada dia. Vem pronta no harness.
  2. Consolidação. Uma rotina que, de tempos em tempos, relê o que foi anotado, promove o que importa e descarta o resto. Sem isso, a memória vira um caderno de rascunho infinito.
  3. Second brain. Um cofre no Obsidian com projetos, pessoas, reuniões, decisões e protocolos. Ele se alimenta sozinho: os monitores escrevem as demandas e os contatos novos, as reuniões viram nota, as sessões de trabalho viram resumo.

O modelo por trás: o LLM Wiki do Karpathy. O second brain da KATIA segue o padrão que o Andrej Karpathy descreveu num gist em 2026: em vez de você organizar as anotações, a IA organiza. São três peças:

  • Material bruto (raw/): tudo que chega, do jeito que chega. Transcrição de reunião, áudio, link salvo, conversa de grupo.
  • Wiki compilada (wiki/): páginas limpas por assunto (cliente, projeto, pessoa, decisão), com links entre elas. Quem escreve é a IA; nas palavras dele, você raramente edita a wiki na mão.
  • Regras (um arquivo como CLAUDE.md ou AGENTS.md): como a IA deve organizar, nomear e ligar as páginas.

E três operações que viram rotina: ingerir (ler o bruto e atualizar a wiki), consultar (responder usando só a wiki, citando a fonte) e revisar (achar link quebrado, página órfã e informação contraditória). O cofre do Colaboratório funciona exatamente assim: os monitores despejam no bruto e a consolidação compila na wiki.

Por que isso importa tanto. O cofre é só uma pasta de arquivos de texto. Ele fica fora do modelo e fora do harness. Eu troquei de harness (do OpenClaw pro Hermes) e a empresa continuou lembrando de cada cliente e cada decisão. E não é só a KATIA que lê: Claude, ChatGPT, Codex e qualquer outro agente que eu use leem e escrevem no mesmo lugar, via MCP (o padrão que liga ferramentas a IAs).

#Como começar

  1. Deixa a memória nativa do harness ligada. Na primeira semana, é suficiente.
  2. Cria um cofre no Obsidian com poucas pastas: projetos, pessoas, reuniões, decisões.
  3. Conecta o cofre ao agente (o Obsidian tem plugin de API local e existem servidores MCP prontos pra ele).
  4. Pede pro agente registrar ali tudo que mudar de estado: um cliente novo, uma decisão, um combinado.

Regra de ouro: o que é importante mora em arquivo que você consegue abrir e ler. Se a memória só existe dentro de um produto, ela é do produto, não sua.

#Camada 4: skills, rotinas, e os hábitos

KATIA de binóculo, vigiando a fila de mensagens

É aqui que o agente deixa de esperar você mandar. Rotina é o que ele faz sozinho, em dois formatos:

  • Programadas (cron): hora marcada. "Todo dia às 7h30, me manda o bom dia."
  • Reativas (heartbeat e gatilhos): o agente acorda de tempos em tempos, olha o que chegou e decide se tem algo a fazer. "Chegou áudio? Transcreve e me diz se é urgente."

Nos dois harnesses você cria rotina em linguagem natural, conversando com o agente. No Hermes também dá pelo terminal, com hermes cron.

#O que a KATIA roda hoje

RotinaQuandoFricção que apaga
Bom dia: agenda, e-mails esperando resposta, o que ficou de ontemTodo dia, 7h30Começar o dia caçando pendência
Transcrição de áudio, com resumo e urgênciaChegou áudioOuvir áudio de 4 minutos
Vigia de grupos: pedido no WhatsApp vira tarefa, sem duplicarA cada 30 minutosPedido que some no grupo
Reunião vira lista com dono e prazoDepois de cada callAta que ninguém escreve
Lead que chega no WhatsApp vira pessoa e oportunidade no CRMConversa novaLead que esfria
Consulta a agenda antes de sugerir horárioAlguém pede reuniãoO vai e volta pra marcar
Banco de referências: posts salvos viram nota transcritaToda madrugadaSalvar e nunca mais achar
Consolidação de memóriaRecorrenteContexto que se perde

#Como começar

Cria uma rotina, a da fricção que você escolheu lá no começo. Escreve do jeito que falaria com alguém da equipe:

Todo dia às 8h, olha minha agenda e meus e-mails e me manda no Telegram: as reuniões do dia, os e-mails que esperam resposta e o que ficou pendente ontem.

Deixa rodar uma semana antes de criar a segunda. Rotina ruim não dá erro: ela só vira barulho, e você para de ler.

#Do computador à VPS: ligado 24 horas

O dono dorme; a KATIA fica de plantão em cima do servidor

No seu computador, o agente dorme quando a tampa fecha. Rotina das 7h30 com o notebook desligado não acontece. Quando a primeira rotina provar que vale a pena, é hora de subir pra um servidor.

Etapa 1, no computador (uma tarde). Instala o harness, pluga o modelo, conecta o Telegram, cria a primeira rotina. O objetivo é ver funcionar, não deixar perfeito.

Etapa 2, na VPS (quando a rotina provou valor). Uma VPS é um computador alugado na nuvem que nunca desliga. Um plano pequeno dá conta de um agente pessoal. Eu uso Hetzner.

  1. Cria a VPS com Ubuntu e acessa por SSH.
  2. Instala o harness com o mesmo comando que você usou no computador.
  3. Configura igual (modelo, canal, rotinas). Se a memória mora em arquivos, é só levar a pasta junto.
  4. Deixa rodando como serviço, pra ele voltar sozinho se o servidor reiniciar:
    • OpenClaw: openclaw gateway install
    • Hermes: hermes gateway install
  5. Não expõe nada na internet sem necessidade. Pro painel e pros serviços internos, use um túnel seguro (Cloudflare Tunnel ou Tailscale) em vez de abrir porta.
  6. Desliga no computador quando a VPS estiver de pé. Duas instâncias no mesmo número de WhatsApp brigam entre si.
Cuidado com o que o agente pode fazer no servidor. Agente com acesso a terminal consegue reiniciar serviço, instalar coisa e apagar arquivo. Na KATIA de cliente, as ferramentas de desenvolvimento ficam desligadas e as skills em modo somente leitura. No seu agente pessoal, pelo menos combina com ele o que precisa da sua aprovação antes.

#A stack da KATIA

KATIA tirando as peças da caixa de ferramentas, uma por uma

O que roda de verdade por trás da KATIA hoje. Você não precisa de tudo isso pra começar: a coluna da direita diz quando cada peça vale a pena.

CamadaPeçaQuando entra
HarnessHermes Agent (veio do OpenClaw)Dia 1
CanalWhatsApp via Baileys, mais Slack e TelegramDia 1 (comece pelo Telegram)
ModelosOpenCode como principal (DeepSeek, GLM); OpenAI e Anthropic pro pesado; cadeia de reservaDia 1 com um só; o resto quando a conta aparecer
Áudiowhisper.cpp, rodando localQuando áudio for sua fricção
MemóriaObsidian como second brain, ligado via MCPSegunda semana
ServidorVPS na HetznerQuando a primeira rotina provar valor
Acesso seguroCloudflare Tunnel e TailscaleJunto com a VPS
Automaçãon8n self-hostedQuando precisar ligar sistemas que o harness não alcança
TarefasLinearQuando o agente começar a criar tarefa
CRMTwenty, aberto e self-hostedQuando o agente começar a cuidar de lead

#Onde costuma travar

KATIA desembaraçando o nó de fios, sem perder a calma

Vai dar alguma coisa errada, e tá tudo bem. Os tropeços mais comuns:

  • Querer que ele faça tudo na primeira semana. Uma fricção, uma rotina. O resto vem depois que a primeira der samba.
  • Fatura surpresa. Rotina frequente com modelo caro e sem limite de gasto. Coloca o limite antes de criar a primeira rotina.
  • Número de WhatsApp bloqueado. Conexão não oficial tem esse risco. Chip dedicado, sempre.
  • Rotina que vira barulho. Se você parou de ler o bom dia, ele não está apagando fricção, está criando. Ajusta ou desliga.
  • Memória que ninguém cuida. Sem consolidação, o agente começa a lembrar de coisa velha e errada. Revisa o cofre uma vez por semana no começo.
  • Agente com poder demais. Terminal liberado em servidor de produção é pedir pra dar ruim. Libera ferramenta aos poucos.

#Próximos passos

KATIA acenando
  1. Faz o exercício da fricção.
  2. Instala o harness no seu computador e conversa com ele.
  3. Liga o Telegram e cria a primeira rotina.
  4. Deixa rodar uma semana e mede: quanto tempo a fricção te comia antes, quanto come agora.

Tenta e me conta se deu samba, ou onde travou.

#Quer que eu monte com você?

Se você chegou até aqui e pensou "quero isso, mas não quero montar sozinho", é exatamente pra isso que o Colaboratório existe. Tem três jeitos de a gente trabalhar junto:

JeitoO que éPra quem
Ensino a fazerEste guia, mais as peças que eu publico toda semanaQuem quer montar e aprender o caminho
Faço com vocêA gente senta junto, mapeia suas fricções e monta o seu agente na sua máquina ou no seu servidor. Você sai sabendo manterQuem quer ter o próprio agente e dominar como ele funciona
Faço pra vocêA KATIA pronta, configurada pro jeito da sua empresa, no WhatsApp ou no Slack, com hospedagem, memória e ajustes inclusosQuem quer o resultado sem mexer em terminal

Tudo começa com uma conversa de 30 minutos, sem compromisso. Você me conta onde está a fricção e eu te digo qual dos três faz sentido, inclusive se for só seguir este guia.

Marca os 30 minutos

Escolhe o jeito que faz mais sentido hoje. Na conversa a gente confirma.

Como você quer fazer? *
Ao enviar, você concorda com a política de privacidade.

Pra me chamar:

#Fontes