Skillware ajoute prompt_rewriter pour la compression déterministe des tokens dans les boucles d'agents de l'API Claude.

Skillware a ajouté une compétence prompt_rewriter qui réduit les coûts de l'API Claude dans les boucles agentiques en compressant les prompts avant de les envoyer au LLM. Le middleware utilise une compression heuristique pour réduire l'utilisation de tokens de 50 à 80 % tout en conservant un comportement déterministe à travers les itérations.
Comment cela fonctionne
L'outil fonctionne comme un middleware qui s'intercale entre votre agent et l'API Claude. Il applique une compression agressive aux prompts avant qu'ils ne soient envoyés au LLM, garantissant que vous ne payez que pour le signal et non pour le bruit. Comme la compression est déterministe, le comportement de l'agent reste stable d'une boucle à l'autre.
Niveaux de compression
- Faible : Normalise les espaces blancs
- Moyen : Supprime les remplissages conversationnels (s'il vous plaît, assurez-vous, etc.)
- Élevé : Supprime agressivement les mots vides et la ponctuation non essentielle
L'outil résout le problème des coûts incontrôlés dans les boucles agentiques itératives où les énormes fenêtres de contexte entraînent des factures colossales. Il est open-source et disponible sur GitHub, le développeur étant à la recherche de plus de compétences, de retours, d'idées et de contributions.
📖 Read the full source: r/ClaudeAI
👀 See Also

Examen des performances du modèle OpenClaw : Codex 5.3 en tête, les modèles GLM déçoivent
Un développeur a testé plusieurs modèles d'IA avec OpenClaw, constatant que Codex 5.3 obtient les meilleurs résultats avec une note de 9/10, tandis que GLM 4.7 et GLM 5 ont obtenu 5/10 en raison d'une consommation élevée de tokens, de réponses lentes et d'une sortie incohérente.

SkyClaw ajoute une configuration de clé API chiffrée basée sur le chat pour les agents IA
SkyClaw met en œuvre l'ingestion de clés chiffrées AES-256-GCM via le chat, en interceptant les commandes de clés au niveau système pour que le LLM ne voie jamais les clés API, et en utilisant un chiffrement à clé unique pour que les plateformes de messagerie ne voient que du texte chiffré.

Savant Commander 48B : Un modèle personnalisé Qwen 3 à base de mélange d'experts, intégrant 12 modèles distillés
Savant Commander 48B est un modèle Qwen 3 Mixture-of-Experts personnalisé avec un routage codé manuellement qui combine 12 modèles distillés provenant de fournisseurs comme Claude, Gemini, OpenAI et Deepseek. Il dispose d'une longueur de contexte de 256K et permet l'activation contrôlée par prompt de modèles distillés spécifiques.

Plan directeur : Un système de tâches terminal minimal conçu pour les utilisateurs de code Claude
Un développeur a créé master-plan, un plugin Claude Code avec quatre commandes slash qui gère les tâches directement dans le terminal en utilisant un fichier markdown et git. Le système capture les idées en plein milieu d'une session sans changer de contexte et détecte automatiquement les exécuteurs de tests.