DocMason: Base de Conhecimento de Agente Local para Arquivos de Escritório Complexos

O que o DocMason faz
DocMason é um sistema de base de conhecimento local baseado em arquivos, projetado para pesquisa profunda em documentos de trabalho privados. O conceito central é "O repositório é o aplicativo. Codex é o ambiente de execução." Ele compila arquivos de escritório em pacotes de evidências estruturadas sobre os quais agentes de IA podem raciocinar, mantendo um rastreamento rigoroso da proveniência.
Principais recursos da fonte
- Lida com vários tipos de documentos de escritório: PPTX, DOCX, XLSX, PDFs e até arquivos .EML
- Extrai informações multimodais, incluindo diagramas de arquitetura de TI e dados de planilhas Excel
- Mantém a estrutura do documento e a semântica visual (layouts de slides, notas do apresentador, referências de planilhas, sinais de formatação)
- Executa localmente sem ingestão em nuvem ou backends ocultos
- Fornece sincronização incremental da base de conhecimento quando arquivos são adicionados ou revisados
- Aplica contratos de dados rigorosos e limites de proveniência
Como funciona
DocMason opera como um ambiente de execução de nível de produção que força a IA a respeitar a estrutura original do documento. Em vez de achatar arquivos complexos em blocos de texto não estruturados, ele cria evidências determinísticas baseadas em arquivos e executa algoritmos de recuperação offline localmente em sua máquina.
Começando
Duas formas de configuração são descritas na fonte:
Caminho A (Comece pequeno):
- Coloque arquivos de trabalho na pasta
DocMason/original_doc/ - Abra a pasta DocMason no Codex
- Faça perguntas naturalmente - o DocMason orienta na configuração do ambiente
- Aprova prompts ao construir a base de conhecimento
Caminho B (Organizar pastas inteiras):
- Coloque pastas de nível de departamento em
DocMason/original_doc/ - Abra no Codex e diga: "Por favor, prepare o ambiente DocMason."
- Depois: "Por favor, construa a base de conhecimento."
- Uma vez concluído, faça perguntas de pesquisa complexas contra todo o corpus
O sistema é projetado para que você não precise memorizar comandos internos - apenas fale naturalmente com seu agente de IA dentro de um espaço de trabalho válido.
Detalhes técnicos
DocMason aborda limitações específicas das ferramentas de IA de documentos existentes:
- Preserva layout visual, notas do apresentador e relações texto-gráfico em apresentações de slides
- Mantém referências de múltiplas planilhas e tabelas aninhadas em planilhas
- Retém semântica de formatação como texto vermelho para "Risco" ou recuo para hierarquias
- Permite raciocínio entre documentos para propostas de múltiplas partes
A estrutura do repositório inclui diretórios de adaptadores, knowledge_base, runtime, skills e sample_corpus, com configuração gerenciada através dos arquivos docmason.yaml e pyproject.toml.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Substituindo Kafka, Redis e RabbitMQ por NATS: A Experiência de um Desenvolvedor
Um desenvolvedor substituiu Kafka, Redis e RabbitMQ por NATS em sua arquitetura, compartilhando detalhes específicos de implementação e lições aprendidas ao consolidar múltiplos sistemas de mensageria em uma única ferramenta.

A documentação do Claude Code inclui componentes React excessivos que inflam as contagens de tokens
Uma análise da documentação do LLM do Claude Code revela que os arquivos MDX contêm componentes React massivamente embutidos, com o arquivo context-window.md usando 18.501 tokens, mas apenas 551 tokens de conteúdo de documentação real.

Claude Counter: Aplicativo Android monitora limites de uso do Claude com notificações em tempo real
Um desenvolvedor criou o Claude Counter, um aplicativo Android gratuito que consulta a API do Claude para exibir limites de uso ao vivo da sessão e semanais. O aplicativo mostra barras de progresso, fornece notificações ricas com porcentagem restante e alerta quando os limites são redefinidos.

Holisto Seed: Um Framework LLM Local com Identidade Persistente e Consolidação de Memória Consensual
Holisto Seed é um Framework de Individuação Relacional que dá aos agentes LLM identidade persistente, memória biográfica e relacionamentos coevolutivos com os usuários. Ele roda totalmente local com um sistema de versionamento baseado em Git e possui um ciclo de sono consensual para consolidação de memória.