Feynman : Agent de Recherche Open Source avec Outil d'Audit Codebase de Papier

Ce que fait Feynman
Feynman est un agent de recherche en ligne de commande open source qui traite les questions de recherche grâce à une architecture multi-agents. Lorsque vous posez une question de recherche, il déploie quatre sous-agents en parallèle :
- Chercheur : Recherche des articles et sur le web
- Réviseur : Exécute une revue par les pairs simulée avec notation de sévérité
- Rédacteur : Produit une sortie structurée
- Vérificateur : Vérifie chaque citation et supprime les liens morts
Fonctionnalités clés de la Source
La fonctionnalité remarquable mentionnée dans la source est l'outil d'audit : Feynman audit [arxiv-id] extrait les affirmations d'un article et les compare à la base de code publique réelle. Cela résout le problème courant de se demander si le code publié implémente réellement ce qui est affirmé dans l'article.
Les autres capacités incluent :
- Réplication d'expériences sur des GPU locaux ou cloud via modal/runpod
- Revues de littérature montrant le consensus vs les désaccords vs les questions ouvertes
- Mode recherche approfondie avec investigation parallèle multi-agents
- Option d'installer uniquement les compétences de recherche dans Claude Code ou Codex sans l'application terminal complète
Détails techniques
- Installation en une commande
- Licence MIT
- Construit sur pi pour le runtime des agents
- Utilise alphaxiv pour la recherche d'articles
- 2,3k étoiles sur GitHub au moment de la publication de la source
- Le tweet de lancement a reçu 2 768 signets d'un compte avec 1 400 abonnés
L'architecture aborde spécifiquement les problèmes d'hallucination courants dans les outils de recherche IA en dédiant un agent entier à la détection des citations incorrectes avant qu'elles n'atteignent l'utilisateur.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Comment Mendral a réduit les coûts des LLM en passant à Opus : schéma de triage, accès SQL et architecture de sous-agent
Mendral est passé de Sonnet à Opus 4.6 pour l'analyse des échecs CI, mais a réduit les coûts en utilisant un trieur Haiku pour écarter 80% des échecs, en donnant aux agents un accès SQL à ClickHouse au lieu de pousser les logs, et en générant des sous-agents bon marché pour effectuer les recherches approfondies.

Plugin OKed : OpenClaw demande votre téléphone avant des actions destructrices
Un nouveau plugin appelé OKed se branche sur le before_tool_call d'OpenClaw pour intercepter les commandes destructrices (emails, suppressions, paiements) et envoyer des demandes d'approbation à votre téléphone ou Telegram.

ClawPy : Implémentation Python Minimaliste en Fichier Unique d'OpenClaw avec Mémoire d'Expérience
Un développeur a créé ClawPy, un script Python simplifié qui implémente les mécanismes d'exécution autonome de tâches d'OpenClaw avec un système d'expérience persistante qui apprend des erreurs et succès passés.

Présentation de Lean Collab : Un Orchestrateur Multi-Agents pour les Tâches LLM de Longue Durée
Lean Collab est un orchestrateur open-source conçu pour gérer des tâches LLM de longue durée en utilisant des sous-agents coordonnés et parallèles.