Knoblauchbauer baut 19.000-Zeilen-KI-Agenten-System auf Android-Handy

Entwicklungsumgebung und System
Ein Knoblauchbauer aus der Provinz Gyeongsang in Südkorea hat ein KI-Agentensystem namens "garlic-agent" entwickelt, das ausschließlich mit einem Android-Handy und der Termux-Terminal-App läuft. Das System besteht aus 19.260 Zeilen Python-Code (wie durch die Abfrage mehrerer KIs bestätigt) und führt komplexe Automatisierungsskripte in einer eigenen Programmiersprache aus.
Das System wechselt zwischen mehreren KI-Anbietern wie Gemini, Groq und NVIDIA, speichert Kontext in SQLite und läuft vollständig auf einem Mobilgerät. Der Bauer beschreibt es als ein "persönliches Projekt im KI-Zeitalter", das ohne PC entwickelt wurde.
Workflow-Methodik
Der gesamte Entwicklungsprozess basiert auf manuellen Copy-Paste-Operationen. Der Workflow folgt diesem Muster:
- Claude bitten, die "Projektgesundheit zu diagnostizieren"
- Claude generiert ein Diagnoseskript
- Skript manuell kopieren (mit Finger gedrückt halten)
- Zu Termux wechseln, einfügen und ausführen
- Ergebnisse kopieren
- Zurück zu Claude wechseln, Ergebnisse zur Analyse einfügen
- Claude generiert Patch-Skripte
- Copy-Paste-Ausführungs-Zyklus wiederholen
Der Bauer berichtet, diesen Zyklus "tausende Male am Tag" durchzuführen und diesen Workflow über "zehntausende Gespräche" mit KI-Systemen beibehalten zu haben.
KI-Rollenaufteilung
Das System verwendet drei primäre KI-Rollen:
- Externe Analyse - Claude: Diagnostiziert Code von außerhalb des Projekts, generiert Diagnoseskripte, kann aber keinen Code direkt ausführen. Erfordert manuelles Eingreifen, um Skripte in Termux auszuführen.
- Interne Ausführung - Gemini: Läuft als API-KI innerhalb von garlic-agent, liest Dateien, führt Befehle aus und gibt Ergebnisse zurück. Hat internes Wissen über die Codebasis aus dem täglichen Betrieb.
- Menschliche Verbindung: Der Bauer fungiert als Middleware zwischen Claude (im Webbrowser) und Gemini (in Termux), überträgt Ergebnisse zwischen beiden Seiten, liefert Fragen und trifft Entscheidungen, wenn KI-Urteile im Konflikt stehen.
Kontextverwaltung
Um mehrere KI-Sitzungen zu verwalten, weist der Bauer am Ende jeder Antwort alias-ähnliche Nummern zu (z.B. analysis21, analysis22, analysis23). Dies hilft, zwischen verschiedenen KI-Instanzen zu unterscheiden, wenn Dutzende Chat-Fenster verwaltet werden. Wenn eine KI einen Eintrag im CHANGELOG hinterlässt, liest die nächste KI ihn und übernimmt, was für Kontextkonsistenz sorgt.
Der Übergabedatensatz ist auf 10.730 Zeilen angewachsen, über etwa eineinhalb Monate Betrieb. Der Bauer betont, dass dieses Maß an Kontextverwaltung "unmöglich zu erklären" sei und empfiehlt, es selbst zu erleben.
Praktische Umsetzung
Das System läuft kontinuierlich - der Bauer kehrt von den Knoblauchfeldern zurück, schaltet den Handybildschirm ein und fährt dort fort, wo er aufgehört hat. Die Entwicklung findet während Pausen beim Knoblauchgraben und nach dem Mittagessen statt. Der Bauer merkt an, dass während KI Kontext erinnert (was menschliches Gedächtnis unnötig macht), der Prozess "jeden Moment sehr viel menschliche Berührung" erfordert.
Der Bauer erklärt ausdrücklich, dass er KI allein nicht vertraut: "Ich vertraue nur meinem Instinkt und Bauchgefühl. Autonomer KI-Agent? Ich wage zu sagen. Präzise Arbeit ist noch weit entfernt. Ich entwickle dieses System nicht, um Reisepläne zu erstellen."
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Entwicklung eines Slay the Spire 2-Agenten mit lokalen LLMs: Erkenntnisse und offene Probleme
Ein Entwickler hat einen Agenten erstellt, der Slay the Spire 2 mithilfe von Qwen3.5-27B über KoboldCPP/Ollama spielt. Dabei wurden etwa 10 Sekunden pro Aktion und eine Erfolgsquote von etwa 88 % erreicht, dank Techniken wie zustandsbasierter Tool-Routing und Single-Tool-Modus, wobei offene Probleme wie Prompt-Konsistenz und Tool-Aufrufzuverlässigkeit identifiziert wurden.

Wie ein Team eine 6-stellige HubSpot-Agentur durch Claude Code ersetzte
Ein mittelständisches E-Commerce-Unternehmen führte seine gesamte HubSpot-Enterprise-Migration mit Claude Code durch und ersetzte damit Angebote von 20.000 bis 80.000 Euro für Teilumsetzungen. In 4 Monaten bauten sie 6 benutzerdefinierte Objekte, 5 n8n-Integrationen und eine KlickTipp-Migration auf – Claude Code übernahm sowohl Code als auch Dokumentation.
Drei Geister: Ein Rahmenwerk für das Zusammenspiel von Mensch und zwei KI-Agenten
Ein Reddit-Nutzer beschreibt ein Muster der Mensch-KI-Zusammenarbeit mit zwei Claude-Agenten, die unterschiedliche Kontexte haben: einer für den täglichen Betrieb, einer für spezialisiertes Fachwissen. Der Mensch gibt die Richtung vor und trifft die endgültigen Entscheidungen.

Claude Opus 4.7 im echten Incident Response: Alleinige Behebung eines Healthcare-Malware-Vorfalls in 5 Stunden
Ein Sicherheitsingenieur nutzte Claude Opus 4.7, um einen Python-Bytecode-RAT zu reverse-engineeren, HIPAA-Risikobewertungen zu entwerfen und 12 forensische Skripte zu schreiben – und erledigte einen Malware-Vorfall in einer 60-Personen-Praxis allein in 5 Stunden, statt wie sonst üblich mit einem 3-6-köpfigen Team eine Woche zu benötigen.