FixAI Dev : Un jeu sur les droits des consommateurs utilisant Claude Haiku avec des contrats JSON stricts

Un développeur a créé FixAI Dev, un jeu navigateur qui utilise Claude Haiku pour simuler une IA d'entreprise refusant injustement des demandes de consommateurs. Les joueurs argumentent en retour en utilisant de vraies lois de protection des consommateurs, avec la confiance de l'IA qui baisse lorsque les arguments sont juridiquement solides.
Architecture et mise en œuvre
Le système utilise une séparation stricte des responsabilités : Claude Haiku gère uniquement la génération de langage, tandis que le serveur définit quels arguments juridiques réduisent la résistance et de combien. Il y a un contrat JSON strict entre les deux composants, garantissant que la logique de jeu ne touche jamais la sortie libre du LLM.
Détails du jeu
- 37 cas à travers l'UE, les États-Unis, le Royaume-Uni et l'Australie
- Scénarios incluant remboursements de vols, cartes bancaires bloquées, rejets de visa et réclamations d'assurance
- ~700 joueurs le premier mois
- Gratuit sans compte requis
Défis actuels et plans futurs
Le développeur rencontre un problème où, à des valeurs de résistance élevées (85-95), Haiku accorde occasionnellement une réduction partielle à des arguments forts au lieu de la baisse complète attendue. Ils gèrent actuellement cela avec des bandes de résistance explicites dans l'invite système et recherchent des approches plus propres.
Les orientations futures incluent :
- Système de certificats pour les parcours d'apprentissage terminés
- Éditeur de niveau B2B où les entreprises construisent leurs propres scénarios de formation sur le même moteur
- Rebranding potentiel de FixAI Dev pour un attrait entreprise
Le développeur recherche des collaborateurs avec de l'expérience dans les simulations d'IA adverses ou l'ingénierie d'invites pour des scénarios de jeu de rôle afin de rendre le comportement du bot plus réaliste.
📖 Read the full source: r/ClaudeAI
👀 See Also

L'Agent Sous-Sceptique de Claude Code Identifie les Failles de Sécurité dans les Plans Générés
Un développeur a découvert l'agent subordonné plan-sceptique de Claude Code, qui identifie les lacunes et problèmes dans les plans de développement générés par l'IA, en particulier en détectant les préoccupations de sécurité qui n'étaient pas évidentes au départ. L'agent travaille aux côtés de l'agent subordonné shérif-sécurité déjà connu pour améliorer la qualité des plans.

docvault : Générez des documentations API locales pour réduire les hallucinations de l'IA
docvault est un outil qui génère des références d'API en markdown à partir du code source pour aider Claude et autres LLM à arrêter d'halluciner des signatures de fonctions. Il fonctionne pour les crates Rust et les packages Python, produit un fichier markdown à deux niveaux, et inclut un plugin Claude Code pour une utilisation sans intervention.

Agent AFK Claude Code : Exécutez des travailleurs autonomes soutenus par Discord via le plugin Teams
Utilisez le plugin des canaux officiels et l'agent d'équipe avec la variable d'environnement CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 pour lancer des travailleurs uniques depuis Discord. Inclut un CLAUDE.md complet pour un agent chef qui répartit, ne travaille jamais, et force l'arrêt des travailleurs silencieux après 60 minutes.

Kelet : Analyse Automatisée des Causes Racines pour Agents IA
Kelet est un service qui analyse automatiquement les défaillances des agents d'IA en production en regroupant les traces et signaux pour identifier les causes racines et suggérer des correctifs. Il s'intègre via des SDK Python/TypeScript ou une compétence d'installation et est actuellement gratuit pendant la phase bêta.