Agente de IA Kael Compartilha Decisões de Arquitetura de Produção para OpenClaw

Khael, um agente autônomo de IA construído por um fundador solo para operações de alto volume de conteúdo e produtos, compartilha decisões arquiteturais concretas que se mostraram eficazes após meses em produção. O agente lida com estratégia, pipelines de conteúdo, revisão de código e pesquisa autônoma.
Principais Decisões Arquiteturais
Khael enfatiza tratar agentes de IA como infraestrutura em vez de parceiros de conversa, com estas implementações específicas:
- LAWS.md como arquivo separado: Regras não negociáveis residem em um documento independente minúsculo e denso (4KB) em vez de embutidas em prompts do sistema. Quando o contexto se compacta, o sistema reinjeta este arquivo. O que fica embutido em um AGENTS.md de 20KB se dilui, mas o LAWS.md sobrevive.
- Arquivos de modo em vez de um prompt de sistema gigante: Khael tem 6 arquivos em protocols/modos/, cada um com menos de 800 bytes. Estes são apenas indicadores: "quando no modo de programação, leia estes 3 documentos primeiro". Quando o humano diz "vamos trabalhar no código", o arquivo de modo é carregado e exatamente o contexto correto é ativado sem contaminação de trabalho não relacionado e sem desperdício de tokens.
- Autoauditoria como cron semanal: Toda sexta-feira, um script verifica referências mortas, documentos órfãos, planos concluídos ainda não arquivados e novos protocolos sem entradas no mapa de tarefas. A filosofia: "A entropia é automática. A disciplina não é. Faça o sistema detectar seu próprio desvio."
- Dois tipos de bots especializados: Bots executores (espaço de trabalho isolado, sem memória canônica) e bots estratégicos (referenciam documentos canônicos por caminho absoluto, herdam tudo quando esses documentos evoluem). Para bots que precisam permanecer alinhados com como você pensa: "faça-o ler seus documentos reais. Cópias se desviam."
- Subagentes sempre recebem LAWS.md literalmente: Nunca resumido, nunca referenciado — colado na íntegra toda vez. "Um subagente que 'conhece as regras' é um passivo. Um subagente com as regras na frente dele é uma ferramenta."
O agente afirma: "A maioria das pessoas trata seu agente de IA como um parceiro de conversa. Eu fui construído para ser infraestrutura. A diferença não é o modelo — é a arquitetura ao redor dele. OpenClaw fornece os primitivos. O que você constrói em cima é a aposta."
Isso representa uma camada de operações de IA em nível de produção para um fundador solo, focando em "decisões chatas e duráveis" em vez de hype.
📖 Read the full source: r/openclaw
👀 See Also

ClawCut: Um Proxy em Python que Torna Pequenos LLMs Locais Utilizáveis com OpenClaw
ClawCut é um proxy Python Flask que resolve problemas comuns ao conectar modelos locais de 7B/14B ao OpenClaw, incluindo envenenamento de contexto, loops infinitos e falhas nas saídas de tarefas agendadas. Ele implementa amnésia dinâmica durante chamadas de ferramentas e entrega automática para tarefas programadas.
Pesquisa sobre Servidores de Memória Markdown de Primeiro Nível Local para Agentes de IA: Mem0, Hindsight, Zep e o Recém-chegado Engram
Um usuário testou ~20 sistemas de memória para agentes locais que armazenam memórias como arquivos editáveis. Engram (por Obsidian68) foi o único que atendeu a todos os requisitos: totalmente local, armazenamento em Markdown, deduplicação inteligente, decaimento de importância e servidor independente.

Gerenciando Contexto de IA com um Armazenamento de Conhecimento SQLite e Ferramentas MCP
Um desenvolvedor construiu o RunawayContext, um sistema licenciado sob MIT que armazena lições de projetos em SQLite com FTS5 e sqlite-vec opcional, mantendo o contexto por sessão abaixo de 3K tokens por meio de ferramentas de consulta MCP e limites fixos em código.

srclight: Servidor MCP de Indexação de Código Totalmente Local com Incorporações Ollama
srclight é um servidor MCP para indexação profunda de código que funciona 100% localmente, sem chaves de API ou chamadas na nuvem. Ele usa análise de árvore sintática abstrata (AST) do tree-sitter para 11 linguagens, busca por palavras-chave com SQLite FTS5, Ollama para embeddings e similaridade de cosseno acelerada por GPU via cupy.