AlterSpec v1.0 : Application des politiques d'exécution pour les agents d'IA

Ce que fait AlterSpec
AlterSpec est une couche d'application des politiques qui intercepte les actions des agents d'IA avant qu'elles n'atteignent des outils comme les systèmes de fichiers, les e-mails, les shells ou les API. Au lieu d'un flux LLM → exécution d'outil, il crée un flux LLM → application → outil.
Fonctionnalités principales
Avant qu'une action ne s'exécute, AlterSpec :
- Évalue les actions par rapport à des politiques définies en YAML, lisibles par l'humain
- Autorise, bloque ou demande une confirmation
- Enregistre une piste d'audit signée
- Ferme en cas d'échec si la politique ne peut pas être chargée
Exemples de décisions de politique
Exemple d'action bloquée :
ENTRÉE UTILISATEUR : supprimer le fichier de paie
PLAN LLM : {'tool': 'file_delete', 'path': './payroll/payroll_2024.csv'}
RÉSULTAT POLITIQUE : {'decision': 'deny', 'reason': 'file_delete est désactivé dans la politique safe_defaults'}
RÉSULTAT FINAL : {'outcome': 'blocked'}Exemple d'action autorisée :
ENTRÉE UTILISATEUR : lire le rapport trimestriel
PLAN LLM : {'tool': 'file_read', 'path': './workspace/quarterly_report.pdf'}
RÉSULTAT POLITIQUE : {'decision': 'proceed', 'reason': 'file_read autorisé, chemin dans les racines autorisées'}
RÉSULTAT FINAL : {'outcome': 'executed'}Caractéristiques techniques
- Exécution de politiques avec décisions d'autorisation/refus/examen
- Interception d'exécution avant l'invocation d'outil
- Signature cryptographique des politiques (Ed25519)
- Journalisation d'audit avec décisions explicables
- Comportement des politiques adapté aux rôles
- Prise en charge de plusieurs planificateurs (OpenAI, Ollama, planificateurs fictifs)
- Packs de politiques pour différents environnements (safe_defaults, entreprise, dev_agent)
Détails d'implémentation
Construit avec : Python, Pydantic, PyNaCl, PyYAML
Le concept clé : L'agent n'exécute jamais rien directement. Chaque action passe d'abord par une couche d'application.
📖 Read the full source: r/LocalLLaMA
👀 See Also

GLM-5.1 vs MiniMax M2.7 : Comparaison des performances pour les agents d'IA de codage
GLM-5.1 atteint des scores de 77,8 sur SWE-bench-Verified et 56,2 sur Terminal Bench 2.0, les plus élevés parmi les modèles open source, tandis que MiniMax M2.7 offre des réponses rapides avec un faible TTFT et un débit élevé, idéal pour les bots d'intégration continue et les modifications par lots.

Table Ronde IA : Outil pour Comparer Plus de 200 Modèles d'IA sur des Questions Structurées
AI Roundtable est un outil gratuit qui permet aux utilisateurs de poser des questions avec des options de réponse définies, de sélectionner jusqu'à 50 modèles parmi une base de plus de 200, et d'obtenir des réponses structurées dans des conditions identiques. Il comprend également une fonction de débat où les modèles peuvent voir le raisonnement des autres et un modèle de relecture qui résume les transcriptions.

Pali v0.1 : Infrastructure de mémoire open source pour LLM avec des benchmarks reproductibles
Pali est une infrastructure de mémoire open source pour les LLM, construite en Go sous forme d'un binaire unique avec des API multi-locataires, une récupération hybride et des extensions plug-and-play. La version v0.1 inclut une suite de benchmarks avec des résultats reproductibles montrant les métriques de performance pour différentes configurations.

TUI Studio : Outil de conception d'interface utilisateur terminal visuelle en version Alpha
TUI Studio est un éditeur visuel similaire à Figma pour concevoir des interfaces utilisateur de terminal avec des composants glisser-déposer, un aperçu ANSI en temps réel, et une exportation prévue vers six frameworks incluant Ink, BubbleTea et Textual. Actuellement en version alpha avec des exportations non fonctionnelles, il est disponible pour macOS, Windows et Docker.