Skillware ajoute prompt_rewriter pour la compression déterministe des tokens dans les boucles d'agents de l'API Claude.

Skillware a ajouté une compétence prompt_rewriter qui réduit les coûts de l'API Claude dans les boucles agentiques en compressant les prompts avant de les envoyer au LLM. Le middleware utilise une compression heuristique pour réduire l'utilisation de tokens de 50 à 80 % tout en conservant un comportement déterministe à travers les itérations.
Comment cela fonctionne
L'outil fonctionne comme un middleware qui s'intercale entre votre agent et l'API Claude. Il applique une compression agressive aux prompts avant qu'ils ne soient envoyés au LLM, garantissant que vous ne payez que pour le signal et non pour le bruit. Comme la compression est déterministe, le comportement de l'agent reste stable d'une boucle à l'autre.
Niveaux de compression
- Faible : Normalise les espaces blancs
- Moyen : Supprime les remplissages conversationnels (s'il vous plaît, assurez-vous, etc.)
- Élevé : Supprime agressivement les mots vides et la ponctuation non essentielle
L'outil résout le problème des coûts incontrôlés dans les boucles agentiques itératives où les énormes fenêtres de contexte entraînent des factures colossales. Il est open-source et disponible sur GitHub, le développeur étant à la recherche de plus de compétences, de retours, d'idées et de contributions.
📖 Read the full source: r/ClaudeAI
👀 See Also

oMLX introduit la mise en cache SSD KV pour Apple Silicon, réduisant les temps de réponse d'OpenClaw de 30 à 90 secondes à 5 secondes.
oMLX est un nouveau backend qui persiste les blocs de cache KV sur SSD au format safetensors, empêchant l'invalidation du cache lorsque le contexte change. Cela réduit les temps de réponse d'OpenClaw de 30 à 90 secondes à 5 secondes lors des tours suivants.

Les utilisateurs d'OpenClaw signalent des goulots d'étranglement dans la planification et la revue avec les agents IA.
Les utilisateurs d'OpenClaw décrivent les flux de travail de planification et de révision comme 'ressemblant à MS-DOS' malgré une génération de code efficace, citant l'intervention manuelle, la fragmentation des documents et la perte de raisonnement lors de la collaboration entre agents. Certains expérimentent avec des éditeurs de documents natifs pour agents comme comment.io et Proof by Every.

MCP Memory Gateway : Un serveur MCP pour la mémoire persistante dans Claude Code
Un développeur a construit un serveur MCP appelé MCP Memory Gateway en utilisant Claude Code comme principal outil de développement. Il fournit à Claude Code une mémoire persistante entre les sessions grâce à la capture de retours, des règles de prévention et l'injection de contexte.
Pourquoi les agents de codage préfèrent Grep à LSP pour la plupart des tâches
Une étude montre que les agents de codage choisissent grep plutôt que les outils basés sur LSP 94 à 100 % du temps pour les tâches simples, mais changent lorsque l'exhaustivité compte. Forcer les chemins sémantiques peut nuire au succès.