Crag : L'outil open-source génère des règles d'agent IA unifiées à partir des configurations de projet

Ce que fait Crag
Crag est un outil open-source qui résout le problème de dérive de configuration entre plusieurs fichiers de règles pour agents de codage IA. Il analyse les configurations existantes de votre projet et génère un fichier de gouvernance unifié, puis compile celui-ci en tous les fichiers de règles spécifiques nécessaires aux différents agents IA.
Le problème qu'il résout
Les développeurs utilisant plusieurs agents de codage IA font face à des défis de gestion de configuration. Selon la source, un développeur maintenait 12 fichiers de règles répartis sur 4 projets (48 fichiers au total), incluant :
- CLAUDE.md pour Claude Code
- AGENTS.md pour Codex
- .cursor/rules/ pour Cursor
- copilot-instructions.md pour Copilot
- Des workflows CI pour appliquer les règles
Ces fichiers ont divergé au fil du temps, causant des problèmes où les agents écrivaient du code que le CI rejetait car les règles de lint ne correspondaient pas. Le problème est passé inaperçu car "personne ne lit les 12 fichiers".
Comment fonctionne Crag
L'outil a deux commandes principales :
crag analyzelit les configurations de votre projet incluant les workflows CI, package.json, tsconfig, et les configurations de testcrag compile --target allgénère tous les fichiers de règles à partir du fichier de gouvernance unifié
L'analyse génère un fichier governance.md (~80 lignes) qui inclut :
- Des garde-fous
- Des directives d'architecture
- Un profil de test
- Des règles de style de code
- Des anti-modèles à éviter
- Des conventions de framework
Le résultat est décrit comme "auto-généré, se lit comme s'il avait été écrit par un ingénieur senior".
Détails techniques
Crag possède plusieurs caractéristiques techniques notables :
- Aucun LLM requis
- Aucune dépendance réseau
- Zéro dépendance
- Sortie déterministe
- Vérification SHA multiplateforme
Pour l'essayer : npx @whitehatd/crag demo (retirer l'espace entre @ et whitehatd)
Source et disponibilité
L'outil est open-source et disponible sur GitHub à https://github.com/WhitehatD/crag.
📖 Read the full source: r/ClaudeAI
👀 See Also

200+ spécifications de conception d'applications en Markdown – Glissez dans Claude ou Cursor pour des clones UI exacts
Une bibliothèque organisée de plus de 200 applications populaires sous forme de spécifications de conception Markdown structurées, avec codes hexadécimaux exacts, échelle typographique, espacements, chaque état d'écran et graphe de navigation. Importez-la dans Claude, Cursor ou tout agent d'IA pour générer des clones SwiftUI, Jetpack Compose ou Expo UI sans deviner les couleurs ou les espacements.

docvault : Générez des documentations API locales pour réduire les hallucinations de l'IA
docvault est un outil qui génère des références d'API en markdown à partir du code source pour aider Claude et autres LLM à arrêter d'halluciner des signatures de fonctions. Il fonctionne pour les crates Rust et les packages Python, produit un fichier markdown à deux niveaux, et inclut un plugin Claude Code pour une utilisation sans intervention.

Boîte à outils Apocalypse IA v0.932 ajoute l'étalonnage, la création de jeux de données et un espace de travail pour agents pour l'IA locale Android.
La boîte à outils AI Doomsday v0.932 introduit des tests de performance pour les LLM locaux sur les appareils Android, un créateur de jeux de données qui convertit les fichiers texte/PDF au format JSON Alpaca, et un espace de travail pour agents IA avec intégration Termux. La mise à jour comprend également l'incrustation de sous-titres avec Whisper et des outils de gestion intégrés pour Ollama.

Backend personnalisé llama.cpp décharge la multiplication matricielle des LLM vers le NPU AMD XDNA2 sur Ryzen AI MAX 385
Un développeur a créé un backend personnalisé pour llama.cpp qui envoie directement les opérations GEMM vers le NPU AMD XDNA2 sur le Ryzen AI MAX 385 (Strix Halo), atteignant 43,7 t/s en décodage avec 0,947 J/tok pour Meta-Llama-3.1-8B-Instruct Q4_K_M. Le chemin de décodage via le NPU économise environ 10W par rapport au Vulkan seul tout en maintenant le débit de décodage.