Système de bandit contextuel auto-hébergé en Rust : Syntra et Lycan pour des systèmes de décision adaptatifs

Deux nouveaux projets open-source visent à apporter la fonctionnalité de bandits contextuels aux systèmes de production sans pile ML Python. Lycan est un petit langage d'exécution de graphes où les nœuds de stratégie sont une primitive de première classe — vous définissez plusieurs implémentations du même contrat, et l'exécution apprend les poids à partir des retours de résultats. Il compile en un graphe binaire exécuté par un runtime Rust sans LLM dans le chemin critique.
Syntra est une appliance Docker/API auto-hébergée qui sert des capsules Lycan compilées. Fonctionnalités clés :
- Multi-locataire, conception orientée mode shadow
- Apprentissage contextuel par
contextKey - Stockage persistant sur système de fichiers
- Journaux séparés d'audit, de décision et de feedback
- Couche de création YAML MVP (pas besoin d'écrire le Lisp sous-jacent)
Les cas d'usage énoncés : décisions répétées où la meilleure option dépend du contexte et où le résultat arrive plus tard — routage de modèle LLM, politique de nouvelle tentative/délai d'attente, sélection de file d'attente, réglage de seuil.
Le dogfooding sur MoEFolio.ai (un panel public de débats boursiers IA avec résultats résolus par le marché sur 30 jours) a révélé la première surprise : le schéma contextKey fusionnait tous les secteurs en unknown car la recherche de secteur ne résolvait les symboles que d'un seul des trois chemins d'entrée. Le bandit était nominalement 5-dimensionnel mais effectivement 2-dimensionnel, apprenant une moyenne intersectorielle. Corriger le pipeline de données, et non l'algorithme, constitue l'essentiel du travail dans les systèmes adaptatifs.
Sous licence Apache-2.0, stade très précoce. L'auteur invite les regards de toute personne ayant travaillé sur des bandits en production.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

SkyClaw : Runtime d'Agent IA Rust pour VPS Cloud avec Contrôle Telegram
SkyClaw est un runtime d'agent IA basé sur Rust de 6,9 Mo conçu pour le déploiement sur VPS cloud avec Telegram comme unique interface. Il exécute des commandes shell, navigue sur le web via Chrome headless, lit/écrit des fichiers et récupère des URL avec un enchaînement d'outils en plusieurs tours.

Comparaison de 8 modèles d'IA de codage sur l'implémentation d'une fonctionnalité TypeScript en conditions réelles
Un développeur a testé 8 modèles d'IA de codage sur l'implémentation d'une commande /rename dans un projet de bot Telegram open-source en TypeScript, en les évaluant sur le coût, le temps d'exécution, la justesse et la qualité technique. GPT-5.4 a obtenu le meilleur score pour la justesse de l'implémentation, tandis que GLM 5 offrait le meilleur rapport coût-performance.

Le pipeline MCP à appel unique réduit l'utilisation des tokens de Claude Code de 74 %.
Un développeur a créé un serveur MCP de moteur contextuel qui fournit à Claude Code un graphe de dépendances des bases de code, réduisant l'utilisation de tokens de 65 % initialement. Un nouveau pipeline en un seul appel réduit encore les tokens de 74 % en éliminant les allers-retours multiples et en dédupliquant les résultats côté serveur.

AlterSpec v1.0 : Application des politiques d'exécution pour les agents d'IA
AlterSpec v1.0 est un moteur d'exécution open-source qui s'intercale entre les agents d'IA et leurs outils, évaluant les actions par rapport à des politiques définies en YAML avant leur exécution. Il fournit des décisions d'autorisation/refus/examen, une signature cryptographique des politiques et une journalisation d'audit.