ClawCut: Um Proxy em Python que Torna Pequenos LLMs Locais Utilizáveis com OpenClaw

O que o ClawCut faz
ClawCut é uma aplicação Python Flask que atua como um proxy entre servidores locais de LLM (como MLX ou Ollama) e o framework OpenClaw. Foi criado para resolver problemas técnicos específicos que tornam modelos locais pequenos (7B/14B) difíceis de usar como assistentes práticos com o OpenClaw.
Principais problemas resolvidos
- Envenenamento de contexto: Modelos pequenos perdem o rastreamento do uso de ferramentas quando veem suas próprias chamadas antigas no histórico do chat
- Loops infinitos: Modelos ficam presos repetindo padrões em vez de executar comandos
- Problemas de saída: Modelos geram código bash como texto simples no chat ou travam em seu próprio histórico após múltiplos comandos
- Falhas em tarefas agendadas: Trabalhos em segundo plano agendados geram respostas que desaparecem porque nenhuma janela de chat ativa está aberta
- Artefatos de LLM: Blocos de markdown vazios, tags XML internas e crases soltas poluem as saídas
- Recusa de upload de mídia: Modelos às vezes se recusam a fazer upload de arquivos gerados
Como funciona
Amnésia dinâmica para chamadas de ferramentas: Durante o chat normal, o histórico é preservado. Quando o proxy detecta que o modelo está tentando usar uma ferramenta do sistema, ele corta temporariamente o histórico antigo do chat, dando ao modelo "visão de túnel" para executar comandos shell de forma limpa sem loops ou alucinações.
Entrega automática universal para tarefas agendadas: O proxy monitora o fluxo do modelo e intercepta respostas de texto limpas no final dos processos de pensamento. Em seguida, força a entrega via chamadas automáticas de ferramentas para WhatsApp, Telegram ou Signal, fazendo com que tarefas agendadas relatem proativamente para seu telefone.
Filtragem de artefatos: Blocos de markdown vazios, tags XML internas e crases soltas são filtrados antes de chegar à interface.
Manipulação de nomes de ferramentas: Manipulações simples de fluxo contornam a recusa dos modelos de fazer upload de arquivos de mídia gerados.
Configuração testada
- Raspberry Pi 5 (8GB) com OpenClaw 3.8
- Mac mini M4 Pro 24GB com MLX-LLM executando Qwen2.5-Coder-7B-Instruct-4bit
- Máquina Windows com Ollama e modelo Qwen 2.5 Coder 14B (planejado para integração com ClawCut)
Limitações
O ClawCut não transforma modelos de 7B em GPT-4. Cadeias de lógica altamente complexas e multi-etapas continuam desafiadoras para modelos pequenos. O proxy aborda especificamente obstáculos técnicos que anteriormente os tornavam quase inutilizáveis como assistentes do dia a dia.
📖 Read the full source: r/openclaw
👀 See Also

Sistema de desenvolvimento de produtos com 31 agentes de código aberto para Claude, com mais de 12.000 linhas de conteúdo
Uma Habilidade Claude de código aberto oferece 31 agentes de IA especializados e 20 frameworks estratégicos que cobrem todos os departamentos da empresa, do produto à conformidade. O sistema licenciado pelo MIT inclui 62 arquivos com mais de 12.000 linhas de conteúdo acionável, conformidade específica por país para várias regiões e um sistema de carregamento inteligente que direciona solicitações de forma eficiente.

ClawCut Proxy Lançado no GitHub para Otimizar OpenClaw para Pequenos LLMs
ClawCut é um proxy experimental que manipula, injeta chamadas JSON e extrai ruído JSON do OpenClaw para reduzir a sobrecarga cognitiva em modelos pequenos (7B-8B) executados em hardware limitado.

GitVelocity: Pontuação por IA de 50 mil PRs Revela Insights sobre Complexidade de Código
O GitVelocity usa o Claude para pontuar pull requests mesclados de 0 a 100 em seis dimensões: escopo, arquitetura, implementação, risco, qualidade e desempenho/segurança. Após analisar mais de 50.000 PRs em TypeScript, Python, Rust, Go, Java e Elixir, a equipe encontrou padrões surpreendentes sobre o tamanho dos PRs, cobertura de testes e adoção de IA.

Pilha de modelo de IA de código aberto para substituição econômica do Claude
Um usuário do Reddit compartilha uma pilha de modelos de IA funcional usando modelos de código aberto como Llama 3.3 70b e DeepSeek R1 32b para execução local, reduzindo os custos mensais de IA de mais de £60 para menos de £3 ao direcionar 90% das tarefas para modelos gratuitos.