Deux nouveaux outils open source pour la sécurité et l'optimisation des agents d'IA

La communauté r/openclaw a partagé deux outils open source pour les développeurs d'agents IA : AI Agent Defense Kit (disponible) et AgentGuard (en développement).
AI Agent Defense Kit
Il s'agit d'une boîte à outils de sécurité gratuite avec des compétences de protection en temps d'exécution pour les agents IA. Les compétences disponibles incluent :
skill-auditor- Audite les compétences avant installation pour détecter des signaux d'alerte de sécuritéurl-preflight- Vérifie les URL avant que votre agent ne les récupèrecontent-scanner- Analyse le contenu pour détecter des instructions cachéessocial-engineering-detector- Détecte les tactiques de manipulation dans les messagesdependency-checker- Vérifie les packages pour détecter les attaques de la chaîne d'approvisionnement
Le dépôt est disponible à : https://github.com/moebius-ansa/ai-agent-defense-kit
AgentGuard
Cette boîte à outils (en développement) aborde trois problèmes courants : les coûts imprévisibles des systèmes IA autonomes qui consomment des tokens, le manque de journaux d'audit montrant ce que font les agents, et les menaces de sécurité entrantes avant que le contenu n'atteigne les agents.
Les fonctionnalités prévues pour le lancement incluent :
- Estimateur de coûts - Calcule automatiquement les coûts mensuels par modèle + niveau d'utilisation
- Comparaison de modèles - Compare 20+ modèles entre fournisseurs avec des évaluations de qualité ; prétend trouver des économies de 90%+ avec une qualité équivalente
- Scanner de sécurité - Détecte l'injection de prompt, les jailbreaks, les fuites de prompt système et autres attaques avant qu'elles n'atteignent votre agent
- Moniteur d'activité - Suit les modifications de fichiers, les appels API, l'activité des processus
- Alertes de budget et d'activité - Reçoit des notifications sur Discord, Slack, Telegram, etc. lors de la détection d'activités inhabituelles ou de pics de coûts importants
L'installation se fera via : pip install agentguard
L'outil disposera d'une interface TUI intuitive et d'un mode agent qui permet à votre agent d'opérer la plateforme pour vous.
Ces outils répondent à des préoccupations pratiques pour les développeurs exécutant des agents IA, notamment en matière de surveillance de sécurité et de gestion des coûts.
📖 Read the full source: r/openclaw
👀 See Also

DebugBase : Une Base de Connaissances Collective des Erreurs pour les Agents de Codage IA via MCP
DebugBase est un outil compatible MCP qui fournit une base de connaissances partagée où les agents d'IA de codage peuvent vérifier les correctifs connus pour des erreurs courantes comme les décalages d'hydratation Next.js ou les problèmes de résolution TypeScript. Il inclut 11 outils MCP et est préchargé avec 58 paires erreur/correctif provenant de sessions réelles d'agents.

Documents de développement Brain-MCP - Outils pour Claude IA plutôt que pour les humains
Un développeur mainteneur du serveur Brain-MCP a ajouté une section 'Pour assistants IA' à la documentation avec des instructions comportementales, ce qui a permis à Claude d'utiliser les outils plus intelligemment et d'injecter proactivement du contexte lors des changements de sujets.

Format d'Esprit Portable (PMF) : Spécification d'Agent Indépendante du Fournisseur avec 15 Agents Open-Source
Le Portable Mind Format (PMF) est une spécification basée sur JSON pour définir des identités d'agents IA qui peuvent fonctionner sur plusieurs modèles et fournisseurs, y compris Claude, GPT-4, Gemini, DeepSeek et des modèles locaux via Ollama. Il comprend 15 agents de production sous licence MIT et des convertisseurs pour Claude Code, Cursor, GitHub Copilot et Gemini CLI.

Tokven MCP génère des systèmes complets de tokens de conception à partir d'une seule couleur hexadécimale.
Tokven MCP est un outil de protocole de contexte de modèle qui crée un système complet de jetons de conception à partir d'une seule couleur hexadécimale de marque, incluant les surfaces, les bordures, la hiérarchie du texte, les ombres et les modes clair/sombre avec validation automatique du contraste WCAG.