Phaselock : Un système de contrôle d'agent IA inspiré des techniques parentales

Phaselock est une compétence d'agent open-source qui applique des techniques parentales pour enfants autistes pour contrôler les agents d'IA de codage. Le développeur a observé que des tâches vagues amènent à la fois les enfants autistes et les agents d'IA à mal interpréter les instructions, conduisant à une exécution incomplète ou incorrecte.
Mécanismes de contrôle fondamentaux
Le système implémente quatre schémas de contrôle spécifiques :
- Portes explicites avant l'action : Utilise un hook BeforeToolUse qui vérifie la présence d'un fichier de porte approuvé sur le disque. Pas de fichier, pas d'écriture. L'IA ne peut pas continuer sans déclaration architecturale préalable.
- Retour immédiat sur les erreurs : Un hook PostToolUse exécute une analyse statique après chaque écriture de fichier (PHPStan, PHPCS, ESLint, ruff, etc.) et injecte les résultats structurés en JSON dans le contexte. L'IA voit exactement ce qui a cassé et se corrige avant de continuer.
- Choix contraints plutôt qu'options ouvertes : Les fonctionnalités complexes sont divisées en tranches ordonnées par dépendance. L'IA travaille une tranche à la fois, chaque tranche s'arrêtant pour une revue humaine avant que la suivante ne commence.
- Règles qui ne peuvent pas être rationalisées : L'application est mécanique via des hooks shell qui autorisent ou bloquent. L'opinion de l'IA sur sa propre production n'est pas une preuve.
Détails techniques
Phaselock fonctionne avec Claude Code, Cursor, Windsurf et tout ce qui prend en charge les hooks et les compétences d'agent. Les connaissances du domaine sont orientées autour de Magento 2 et PHP, mais l'architecture d'application est indépendante du langage.
L'implémentation actuelle a une limitation d'échelle : elle charge toutes les règles dans le contexte à chaque session. À 80 règles, c'est gérable, mais à 500 règles, vous brûlez du contexte avant même que la tâche ne commence, et à 10 000 règles, c'est physiquement impossible.
Développement futur : Writ
Le développeur construit Writ comme solution au problème d'échelle. C'est un système de récupération hybride qui détermine quelles règles sont importantes à l'instant présent et ne renvoie que celles-ci, atteignant des temps de réponse inférieurs à 10 ms et une réduction de contexte de 726x à 10 000 règles. Le système est encore expérimental et en cours de tests de résistance.
Le développeur note que l'évaluation reste le problème non résolu le plus difficile. Les requêtes de vérité terrain sont synthétiques à 80 règles, et il n'est pas clair si la qualité de la récupération se maintient sur des requêtes réelles issues de sessions réelles.
📖 Read the full source: r/ClaudeAI
👀 See Also

Wolfram Tech désormais disponible en tant qu'outil de base pour les systèmes LLM
Stephen Wolfram annonce que le langage Wolfram est désormais disponible en tant qu'outil fondamental pour les systèmes LLM, fournissant un calcul approfondi et des connaissances précises pour compléter les capacités des LLM. Cette annonce fait suite à trois ans de développement depuis la sortie initiale du plugin Wolfram pour ChatGPT en mars 2023.

Démonstration pour les micropaiements d'agent IA utilisant x402 et Solana
La démo x402-hello illustre comment des agents IA peuvent gérer de manière autonome des micropaiements en utilisant l'USDC sur la blockchain Solana.

Les crochets de code Claude empêchent les interférences entre les onglets Chrome lors de sessions multiples.
Un développeur a créé trois hooks (session-start, capture-tab-id, enforce-tab-id) qui épinglent chaque session Claude Code à son propre onglet Chrome, empêchant les sessions d'accéder accidentellement aux onglets d'autres sessions lors des exécutions de tests et des remplissages de formulaires.
Spine Swarm : Système d'IA Multi-Agents sur Toile Visuelle pour Projets Non-Codés
Spine Swarm est un système multi-agents qui fonctionne sur un canevas visuel infini pour mener à bien des projets complexes non liés au codage, tels que l'analyse concurrentielle, la modélisation financière, les audits SEO, les pitch decks et les prototypes interactifs. Le système utilise des blocs comme abstractions au-dessus des modèles d'IA, qui peuvent être connectés pour transmettre le contexte entre différents types de modèles.