Feynman: Open-Source-Forschungsagent mit Tool zur Überprüfung von Papier-Codebasen

Was Feynman macht
Feynman ist ein Open-Source-Forschungsagent-CLI, der Forschungsfragen durch eine Multi-Agenten-Architektur bearbeitet. Wenn Sie eine Forschungsfrage stellen, setzt es vier Subagenten parallel ein:
- Forscher: Sucht nach wissenschaftlichen Arbeiten und im Web
- Gutachter: Führt simulierte Peer-Review mit Schweregradbewertung durch
- Autor: Erstellt strukturierte Ausgaben
- Prüfer: Überprüft jede Zitation und entfernt tote Links
Wichtige Funktionen aus der Quelle
Die herausragende Funktion, die in der Quelle erwähnt wird, ist das Audit-Tool: Feynman audit [arxiv-id] holt die Behauptungen einer wissenschaftlichen Arbeit und vergleicht sie mit der tatsächlichen öffentlichen Codebasis. Dies behebt das häufige Problem, ob veröffentlichter Code tatsächlich das implementiert, was in der Arbeit behauptet wird.
Weitere Fähigkeiten umfassen:
- Experimentreplikation auf lokalen oder Cloud-GPUs über modal/runpod
- Literaturübersichten, die Konsens vs. Meinungsverschiedenheiten vs. offene Fragen zeigen
- Tiefenforschungsmodus mit paralleler Multi-Agenten-Untersuchung
- Option, nur die Forschungskompetenzen in Claude Code oder Codex zu installieren, ohne die vollständige Terminal-App
Technische Details
- Ein-Kommando-Installation
- MIT-Lizenz
- Auf pi für die Agentenlaufzeit aufgebaut
- Verwendet alphaxiv für die Papiersuche
- 2.3k Sterne auf GitHub zum Zeitpunkt der Quellenveröffentlichung
- Launch-Tweet erhielt 2.768 Lesezeichen von einem Konto mit 1.400 Followern
Die Architektur adressiert speziell Halluzinationsprobleme, die bei KI-Forschungstools üblich sind, indem sie einen gesamten Agenten dafür einsetzt, falsche Zitationen abzufangen, bevor sie den Benutzer erreichen.
📖 Quelle vollständig lesen: r/LocalLLaMA
👀 Siehe auch

Claude Code unterstützt jetzt über 240 Modelle über das NVIDIA NIM Gateway – darunter Nemotron-3 120B für agentisches Programmieren
Claude Code kann während einer Sitzung über den Befehl /model auf über 240 NVIDIA NIM Modelle umschalten. Die Denkvariante von Nemotron-3 Super 120B zeigt starke Ergebnisse bei der Umstrukturierung mehrerer Dateien und agentischen Aufgaben.

Ziel für Claude Code: beständige Aufgaben mit adversarischer Überprüfung
Ein /goal-Befehl für Claude Code, der es ihm ermöglicht, über viele Iterationen hinweg an einer langwierigen Aufgabe zu arbeiten, mit einer optionalen separaten Claude-Sitzung, die das Endergebnis prüft, um eine vorzeitige Fertigstellung zu verhindern.

Sentinel: Selbst gehostete Agenten-Plattform für Claude Code-Abonnenten
Sentinel ist eine kostenlose, Open-Source-Agentenplattform, die direkt auf Ihrem bestehenden Claude Code OAuth-Token läuft, ohne API-Overhead. Sie bietet eine saubere Operator-Benutzeroberfläche mit Echtzeit-Browser-Automatisierung über integriertes VNC und umfasst Funktionen wie Git-Gating, Sitzungsprotokolle und strukturiertes hierarchisches Gedächtnis.

OpenClaw-Fähigkeit reduziert Agentenübergaben durch Ermöglichung der Selbstausführung
Eine neue Fähigkeit für OpenClaw-Agenten adressiert das häufige Problem, bei dem Agenten den nächsten Schritt identifizieren, aber bei 'Hier ist, was als Nächstes zu tun ist' stoppen und eine menschliche Übergabe erfordern. Die Fähigkeit ermöglicht es Agenten, bestimmte Aktionen selbst auszuführen, wie Registrieren, Posten, Antworten und Unterschreiben.