Agent Factory: Autonomes System erstellt KI-Agenten aus Online-Problemdiskussionen

Agent Factory ist ein autonomes System, das KI-Agenten erstellt, indem es reale Probleme aus Online-Diskussionen identifiziert. Inspiriert von Andrej Karpathys Autoresearch-Muster wendet es denselben Ansatz „Experimente über Nacht laufen lassen, behalten, was funktioniert, verwerfen, was nicht funktioniert“ auf die Ideengenerierung anstatt auf die ML-Optimierung an.
So funktioniert es
Das System durchsucht Reddit, Hacker News, GitHub und Twitter nach echten Problemen, die Menschen online diskutieren. Es bewertet jede potenzielle Idee nach drei Kriterien: Nachfrage, Marktlücke und Umsetzbarkeit. Wenn eine Idee eine Qualitätsschwelle überschreitet, erstellt das System automatisch einen eigenständigen KI-Agenten, überprüft, ob er funktioniert, und committet ihn. Die Schwelle erhöht sich mit jedem Build und erfordert zunehmend bessere Ideen.
Praktische Umsetzung
Das Projekt besteht aus drei Schlüsseldateien:
program.md- Teilt Claude Code mit, wo es recherchieren und welche Qualitätshürde es erreichen sollseed/- Eine minimale Next.js-Vorlage mit 7 Toolsrun.sh- Startet Claude Code im Headless-Modus und startet bei Kontextlimits automatisch neu
Das System ist mit TypeScript gebaut, verwendet die MIT-Lizenz und läuft entweder auf OpenRouter oder Ollama. Es vermeidet speziell LangChain- und CrewAI-Frameworks. Jeder generierte Agent ist eigenständig und kann unabhängig geklont und ausgeführt werden.
Beispielausgabe
In seiner ersten Sitzung generierte das System 20 Agenten, darunter:
freelancer-deduction-finder- Für Freiberufler, die nach verpassten Steuerabzügen fragenwage-rights-advisor- Für Menschen, die über Überstundenausnahmen verwirrt sinddata-broker-opt-out- Für Menschen, die von Data-Broker-Opt-Outs überfordert sind
Qualitätsüberprüfung
Das System startet jeden Agenten, sendet eine Testaufforderung und prüft, ob die Ausgabe nützlich ist. Der Ersteller räumt jedoch ein, dass es sich um MVPs handelt und einige grob sind. Der Hauptzweck ist die Ideengenerierung – der Ersteller überprüft die ausgelieferten Agenten jeden Morgen und wählt den vielversprechendsten für die Weiterentwicklung als echtes Projekt aus.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Shipshots MCP-Server: Claude entwirft App Store-Screenshots und Vorschau-Videos
Shipshots ist ein visueller Editor mit einem MCP-Server, der Claude ermöglicht, Marketingmaterialien durch Tool-Aufrufe zu gestalten. Es generiert App-Store-Screenshots, animierte Vorschauvideos und Social-Media-Grafiken basierend auf Textbeschreibungen.

DAUB MCP Server ermöglicht es Claude, Benutzeroberflächen über JSON-Spezifikationen zu generieren und darzustellen
DAUB ist ein MCP-Server, der es Claude ermöglicht, direkt aus natürlichen Sprachbefehlen Benutzeroberflächen zu generieren. Er erzeugt strukturierte JSON-Spezifikationen, die als Live-Interfaces gerendert werden, ohne Codegenerierung oder Kompilierung. Er bietet vier Werkzeuge: generate_ui, render_spec, validate_spec und get_component_catalog.

Benchmarking von 88 kleinen GGUF-Modellen auf einem Mac Mini M4 mit 16 GB
Eine automatisierte Pipeline testete 88 GGUF-Modelle auf einem Mac Mini M4 mit 16 GB RAM, identifizierte 9 als unbrauchbar und 4 LFM2-8B-A1B-MoE-Modelle auf der Pareto-Front für Geschwindigkeit und Qualität.

Rat: Ein strukturierter Dialograhmen für Claude
Rat — Ein Tiegel ist ein strukturierter Dialograhmen, der innerhalb eines einzigen Claude-Kontextfensters läuft und Personendarstellungen nutzt, um vier verschiedene Engagement-Modi zu erzeugen: rigorose Befragung, generatives Handeln, gelebte Erfahrung und ungeformte Intuition.