Le moteur de RPG solo open-source utilise trois instances Claude pour l'analyse, la narration et la direction.

Architecture et Pipeline
EdgeTales est un moteur de jeu de rôle solo basé sur Python où les joueurs tapent les actions de leur personnage, la mécanique des dés résout les résultats en arrière-plan, et l'IA Claude écrit une prose atmosphérique basée sur les résultats. Le principe de conception fondamental est "l'IA narre, elle ne décide pas" — les dés déterminent le succès ou l'échec, tandis que Claude se contente de transformer les résultats en histoire.
Le système utilise un pipeline triple-IA avec trois instances Claude par tour de joueur :
- Cerveau (Claude Haiku) : Analyse l'entrée en texte libre pour la transformer en JSON structuré avec des champs comme action RPG, statistique, PNJ cible, niveau de position/effet. Prend ~300 ms et coûte ~0,0002 $.
- Narrateur (Claude Sonnet) : Reçoit des invites structurées avec les résultats des dés, le contexte des PNJ et l'arc narratif, puis écrit une prose atmosphérique. Intègre également des métadonnées cachées (
<new_npcs>,<memory_updates>) que l'analyseur extrait pour mettre à jour l'état du jeu. Prend ~2 s et coûte ~0,003 $. - Directeur (Claude Haiku) : Fonctionne de manière asynchrone après que le joueur a vu la narration. Analyse les scènes comme un showrunner de série télévisée pour obtenir des indices sur le comportement des PNJ, le suivi des fils narratifs et les résumés de scènes. Ne se déclenche que sur des événements spécifiques (jets de dés échoués, nouveaux PNJ, toutes les 3 scènes) avec une latence nulle pour le joueur.
Le coût total par tour est d'environ 0,003–0,004 $, ce qui fait qu'une session de 20 scènes coûte environ 6–8 cents. La sortie du Directeur est placée dans des balises <director_guidance> dans la prochaine invite du Narrateur, avec une dégradation gracieuse si le Directeur échoue.
Détails de mise en œuvre technique
Leçons d'ingénierie des invites :
- L'injection de contexte XML structuré (
<world>,<character>,<npc>,<story_arc>,<director_guidance>) a rendu la sortie de Sonnet plus cohérente que les instructions en prose. - Haiku est efficace pour l'analyse structurée — le Cerveau renvoie un JSON valide avec 8+ champs à partir d'une entrée multilingue en forme libre.
- La réparation JSON est essentielle. Les deux modèles produisent occasionnellement un JSON malformé (virgules manquantes dans le texte allemand, nouvelles lignes non échappées, virgules finales). Une fonction
_repair_json()avec une approche "essayer d'abord" gère cela sans surcharge pour le JSON valide. - La déduplication des PNJ utilise trois filets de sécurité : des balises explicites
<npc_rename>, une correspondance approximative de sous-chaîne avant la création, et une recherche prenant en compte les alias.
Système de mémoire des PNJ : Chaque PNJ a une mémoire pondérée par l'importance calculée comme Score = 0,40 × Récence + 0,35 × Importance + 0,25 × Pertinence. Le Directeur génère des "réflexions" (comment un PNJ se sent) parallèlement aux observations factuelles. La mémoire reste limitée à 25 entrées par PNJ avec une consolidation intelligente.
Pile technique : Python 3.11+, NiceGUI, SDK Anthropic, EdgeTTS/Chatterbox (synthèse vocale), Faster-Whisper (reconnaissance vocale). La base de code fait environ 6 800 lignes réparties sur 5 fichiers. Les fonctionnalités incluent plus de 20 langues de narration, entrée/sortie vocale, export PDF, mode adapté aux enfants et compatibilité Raspberry Pi.
📖 Lire le code source complet : r/ClaudeAI
👀 See Also

Memento v1.0 : Serveur MCP à Mémoire Persistante pour Claude Code avec 17 Outils
Memento v1.0 est un serveur MCP de mémoire persistante pour Claude Code qui propose 17 outils, une recherche hybride, une détection de contradictions et un graphe de mémoire visuel. Il s'exécute localement sans dépendances cloud et prend en charge plusieurs IDE, dont Claude Code, Cursor, Windsurf et OpenCode.

Utilyze : Moniteur GPU Open Source qui mesure le débit de calcul réel, pas seulement l'activité du noyau
Utilyze échantillonne les compteurs de performance matériels pour rapporter le débit de calcul et de mémoire par rapport aux limites théoriques, révélant que des tableaux de bord affichant une utilisation à 100 % peuvent n'atteindre que 1 à 10 % de débit réel.

Pali v0.1 : Infrastructure de mémoire open source pour LLM avec des benchmarks reproductibles
Pali est une infrastructure de mémoire open source pour les LLM, construite en Go sous forme d'un binaire unique avec des API multi-locataires, une récupération hybride et des extensions plug-and-play. La version v0.1 inclut une suite de benchmarks avec des résultats reproductibles montrant les métriques de performance pour différentes configurations.

CogniLayer : Un serveur MCP pour la mémoire persistante dans Claude Code
CogniLayer est un serveur MCP open-source qui fournit à Claude Code une mémoire persistante entre les sessions en utilisant une base de données SQLite avec recherche en texte intégral FTS5 et des embeddings vectoriels. Il résout le problème de Claude qui oublie le contexte du projet entre les sessions.