Méthode de codage AI en laisse courte : battre Fable en gardant le contrôle

✍️ OpenClawRadar📅 Publié: July 3, 2026🔗 Source
Méthode de codage AI en laisse courte : battre Fable en gardant le contrôle
Ad

Greg Slepak, mainteneur de logiciels critiques pour la sécurité, distille plus d'un an de recherche sur les agents de codage IA dans la méthode de la laisse courte. Elle est conçue pour les développeurs experts qui veulent que l'IA augmente leur productivité sans sacrifier la qualité — et prétend surpasser les résultats de Fable 5 même sans modèles de pointe.

Le problème central identifié par Slepak : les agents IA « déraillent » régulièrement, produisent du code laid/inefficace, ou nécessitent des systèmes d'orchestration à la YouTuber qui retirent le développeur de la boucle. Sa méthode vous garde le contrôle à chaque étape.

Règles de la laisse courte

  • Planifiez la tâche, éventuellement en utilisant quelque chose comme tasks skill pour décomposer les grandes tâches en étapes.
  • N'utilisez jamais le mode « YOLO » (alias « sauter dangereusement les permissions »).
  • L'IA ne travaille que pendant que vous regardez — pas de « codage ambiant » pendant que vous jouez aux jeux vidéo.
  • Utilisez un agent de codage qui affiche un diff dans l'invite de permissions avant d'apporter des modifications.
  • Analysez chaque diff proposé — refusez les permissions chaque fois que l'IA s'apprête à faire quelque chose que vous ne souhaitez pas.
  • Restez dans la boucle pour maintenir une compréhension à jour de la base de code.
  • Intervenez fréquemment pour empêcher l'IA de dérailler.
  • Validez après chaque sous-tâche pour vous protéger contre la suppression de travaux antérieurs par l'IA (Slepak a vu Opus le faire).
Ad

Revues IA

Slepak recommande de traiter l'IA comme un linter pour les revues de PR. L'IA attrape les erreurs courantes, l'humain attrape les problèmes de haut niveau. Les deux ensemble surpassent l'un ou l'autre seul. L'IA a besoin d'un contexte suffisant (issue, description de PR).

Il note également qu'il a construit des outils de revue IA personnalisés aussi performants que des systèmes de plusieurs milliards de dollars, et qu'il maintient un fork d'un agent appelé Crush.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Architecture Multi-Agents : Éviter le piège de l'agent unique dans les systèmes d'IA
Guides

Architecture Multi-Agents : Éviter le piège de l'agent unique dans les systèmes d'IA

Un post Reddit identifie l'erreur architecturale courante d'utiliser un seul agent pour plusieurs tâches, ce qui conduit à des systèmes fragiles nécessitant une surveillance constante. La solution proposée est un modèle orchestrateur-spécialiste où chaque agent a un rôle étroit et spécifique.

OpenClawRadar
Traiter les Sous-agents OpenClaw comme des Fonctions sans État plutôt que comme des Membres d'Équipe Persistants
Guides

Traiter les Sous-agents OpenClaw comme des Fonctions sans État plutôt que comme des Membres d'Équipe Persistants

Un développeur partage son expérience de passage d'une approche où les sous-agents OpenClaw étaient traités comme des membres d'équipe persistants avec des personnalités, à une vision où ils sont considérés comme des appels de fonction sans état avec des objectifs spécialisés.

OpenClawRadar
Optimisation de GLM-4.7-Flash sur Mac Mini M4 avec 24 Go de RAM
Guides

Optimisation de GLM-4.7-Flash sur Mac Mini M4 avec 24 Go de RAM

Un développeur partage des détails de configuration spécifiques pour exécuter GLM-4.7-Flash sur un Mac Mini M4 avec 24 Go de RAM, incluant la quantification Q3_K_XL, une taille de contexte de 32k avec MLA, et les réalités d'allocation mémoire pour Metal.

OpenClawRadar
Limites de débit de l'API Claude : Fenêtres horaires, gestion du contexte et surcharge MCP
Guides

Limites de débit de l'API Claude : Fenêtres horaires, gestion du contexte et surcharge MCP

L'analyse des limites de débit de l'API Claude révèle des restrictions plus strictes pendant les heures de pointe (5h-11h PT / 8h-14h ET en semaine), avec la gestion du contexte et l'utilisation du serveur MCP ayant un impact significatif sur la consommation de tokens. Les stratégies pratiques incluent le travail en dehors des fenêtres de pointe, le démarrage de nouvelles conversations pour chaque nouvelle tâche et l'audit des intégrations MCP.

OpenClawRadar