O compilador SMELT reduz o uso de tokens do espaço de trabalho OpenClaw em até 95%.

✍️ OpenClawRadar📅 Publicado: April 6, 2026🔗 Source
O compilador SMELT reduz o uso de tokens do espaço de trabalho OpenClaw em até 95%.
Ad

Ferramenta de otimização de tokens para workspace OpenClaw

O SMELT é um compilador Python que processa arquivos markdown do workspace do OpenClaw para reduzir o uso de tokens ao enviar conteúdo para modelos de IA como Claude ou GPT. A ferramenta aborda uma ineficiência específica: o OpenClaw reenvia USER.md, SOUL.md, MEMORY.md e AGENTS.md em cada mensagem, não apenas na inicialização.

Benchmarks de desempenho

Testes em um modelo Qwen 3.5 122B em hardware M3-Ultra revelaram:

  • Pacote de inicialização: 7.268 tokens reprocessados em cada chamada de inferência
  • Sessão de 50 mensagens: Mais de 350.000 tokens de arquivos estáticos do workspace reprocessados
  • Reduções específicas de tokens por consulta:
    • "Quem é Sally?": 1.373 tokens brutos → 73 tokens SMELT (94,7% de economia)
    • "Quando John nasceu?": 1.374 tokens brutos → 62 tokens SMELT (95,5% de economia)
    • Consulta ampla "Conte-me sobre Alex": 1.373 tokens brutos → 328 tokens SMELT (76,1% de economia)
  • TTFT de inicialização: 14.121ms bruto → 13.273ms SMELT (6% mais rápido)
Ad

Implementação técnica

O SMELT usa uma arquitetura de quatro camadas:

  1. Arquivo: Os arquivos originais nunca são alterados
  2. Compilação: Compressão estrutural com conhecimento do esquema
  3. Compressão: Substituição por dicionário
  4. Seleção: Recuperação condicionada por consulta que envia apenas registros relevantes com contexto pai

A quarta camada (Seleção) é onde ocorre a redução de 95% dos tokens. O compilador tem conhecimento do esquema e foi construído especificamente para as convenções de arquivos do workspace do OpenClaw.

Principais descobertas do desenvolvimento

  • A conversão ingênua para JSON (uma tentativa comum de otimização) é 30% pior que o markdown bruto
  • A remoção de cabeçalhos fornece benefício mínimo (7-8% de melhoria)
  • Compressão de bytes e compressão de tokens são diferentes - as medições devem usar o tokenizador real
  • 11 dos 13 arquivos de teste alcançaram 100% de fidelidade, com dois arquivos de arquivo denso tendo falhas documentadas

Limitações atuais e disponibilidade

O esquema é construído manualmente para as convenções do workspace do OpenClaw. O suporte para markdown arbitrário requer aprendizado de esquema (planejado). A ferramenta é gratuita para uso pessoal, com código disponível no GitHub em TooCas/SMELT e pesquisa publicada no Zenodo com DOI.

O projeto foi construído com GPT, Claude e Codex como colaboradores.

📖 Read the full source: r/openclaw

Ad

👀 See Also

Plugin OpenClaw Context Meter Mostra Porcentagem de Uso de Token do Telegram
Tools

Plugin OpenClaw Context Meter Mostra Porcentagem de Uso de Token do Telegram

Um novo plugin OpenClaw exibe a porcentagem de uso de tokens após cada resposta do bot do Telegram, mostrando valores como '45k / 200k (22%)' e detectando eventos de compactação. O plugin evita problemas de OOM ao codificar as janelas de contexto em vez de usar execSync.

OpenClawRadar
OnUI: Extensão de Navegador para Feedback Preciso de Interface ao Claude Code
Tools

OnUI: Extensão de Navegador para Feedback Preciso de Interface ao Claude Code

OnUI é uma extensão de navegador que permite anotar elementos de páginas web e exportar relatórios estruturados para o Claude Code via MCP local, eliminando descrições ambíguas de interface. Desenvolvida principalmente com o Claude Code, é gratuita, de código aberto e disponível para Chrome, Edge e Firefox.

OpenClawRadar
Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX
Tools

Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX

Um desenvolvedor quantizou um modelo Qwen 3.5 27B destilado a partir de trajetórias de raciocínio do Claude 4.6 Opus, reduzindo-o de 55,6GB para 14GB usando MLX para Apple Silicon, alcançando ~16 tokens/seg em um M4 Pro enquanto mantém as capacidades de raciocínio analítico do modelo.

OpenClawRadar
SuperHQ: Execute agentes de codificação de IA em sandboxes microVM isolados
Tools

SuperHQ: Execute agentes de codificação de IA em sandboxes microVM isolados

SuperHQ é um aplicativo open source Rust/GPUI que executa agentes de codificação de IA (Claude Code, OpenAI Codex, Pi) em sandboxes isolados de microVM. Cada agente recebe uma VM Debian completa, monta diretórios do projeto como somente leitura e nunca vê as chaves de API do host — elas são injetadas através de um proxy gateway de autenticação.

OpenClawRadar