ClawCut : Un proxy Python qui rend les petits LLM locaux utilisables avec OpenClaw

Ce que fait ClawCut
ClawCut est une application Python Flask qui agit comme un proxy entre les serveurs LLM locaux (comme MLX ou Ollama) et le framework OpenClaw. Il a été créé pour résoudre des problèmes techniques spécifiques qui rendent les petits modèles locaux (7B/14B) difficiles à utiliser comme assistants pratiques avec OpenClaw.
Problèmes clés résolus
- Empoisonnement du contexte : Les petits modèles perdent la trace de l'utilisation des outils lorsqu'ils voient leurs propres anciens appels d'outils dans l'historique du chat
- Boucles infinies : Les modèles restent bloqués à répéter des motifs au lieu d'exécuter des commandes
- Problèmes de sortie : Les modèles sortent du code bash sous forme de texte brut dans le chat ou s'étouffent avec leur propre historique après plusieurs commandes
- Échecs des tâches cron : Les tâches planifiées en arrière-plan génèrent des réponses qui disparaissent car aucune fenêtre de chat active n'est ouverte
- Artefacts LLM : Les blocs markdown vides, les balises XML internes et les backticks pendants encombrent les sorties
- Refus de téléchargement de médias : Les modèles refusent parfois de télécharger les fichiers générés
Comment ça fonctionne
Amnésie dynamique pour les appels d'outils : Pendant le chat normal, l'historique est préservé. Lorsque le proxy détecte que le modèle tente d'utiliser un outil système, il coupe temporairement l'ancien historique du chat, donnant au modèle une "vision tunnel" pour exécuter des commandes shell proprement sans boucles ni hallucinations.
Livraison automatique universelle pour les tâches cron : Le proxy surveille le flux du modèle et intercepte les réponses texte propres à la fin des processus de réflexion. Il force ensuite la livraison via des appels d'outils automatiques vers WhatsApp, Telegram ou Signal, faisant que les tâches cron rapportent proactivement sur votre téléphone.
Filtrage des artefacts : Les blocs markdown vides, les balises XML internes et les backticks pendants sont filtrés avant d'atteindre l'interface frontale.
Manipulation des noms d'outils : De simples manipulations de flux contournent le refus des modèles de télécharger les fichiers multimédias générés.
Configuration testée
- Raspberry Pi 5 (8GB) avec OpenClaw 3.8
- Mac mini M4 Pro 24GB avec MLX-LLM exécutant Qwen2.5-Coder-7B-Instruct-4bit
- Machine Windows avec Ollama et le modèle Qwen 2.5 Coder 14B (prévu pour l'intégration ClawCut)
Limitations
ClawCut ne transforme pas les modèles 7B en GPT-4. Les chaînes logiques multi-étapes très complexes restent difficiles pour les petits modèles. Le proxy s'attaque spécifiquement aux obstacles techniques qui les rendaient auparavant presque inutilisables comme assistants quotidiens.
📖 Read the full source: r/openclaw
👀 See Also

Détection proactive de la perte de contexte dans Claude Code : une suggestion de fonctionnalité de r/ClaudeAI
Une suggestion de fonctionnalité pour Reddit propose que Claude Code détecte de manière proactive la dégradation du contexte et offre un transfert structuré limité à la tâche, générant un fichier de transfert et lançant automatiquement une nouvelle session.

Quiver : Une interface graphique pour gérer et synchroniser les compétences en code Claude
Quiver est un outil GUI gratuit et open source qui fournit une interface web pour gérer les compétences Claude Code, permettant aux utilisateurs de parcourir les compétences locales et les plugins du marketplace, d'éditer les fichiers SKILL.md, de synchroniser via Git et d'installer des compétences sans utiliser le terminal.

Orion : Contourner CoreML pour exécuter et entraîner des LLM directement sur le Neural Engine d'Apple
Orion est un système open-source en Objective-C qui contourne CoreML d'Apple pour exécuter et entraîner des LLM directement sur le moteur neuronal Apple (ANE), atteignant plus de 170 tokens/s pour le décodage GPT-2 124M et un entraînement stable multi-étapes sur un transformateur de 110 millions de paramètres.

Compétence de Lancement de Produit Claude IA : Playbooks Structurés pour les Lancements de Produits IA
Une compétence Claude gratuite fournit six playbooks de lancement éprouvés au combat couvrant la stratégie, la préparation, la messagerie et l'exécution des canaux pour les lancements de produits d'IA. Le dépôt comprend des documents en anglais et en chinois organisés par étape de lancement.