Gemma 4 E2B als Multi-Agenten-Koordinator in TypeScript-Framework getest

✍️ OpenClawRadar📅 Veröffentlicht: 14. April 2026🔗 Source
Gemma 4 E2B als Multi-Agenten-Koordinator in TypeScript-Framework getest
Ad

Koordinator-Fähigkeiten getestet

Der Test bewertete, ob Gemma 4 E2B die Koordinatorrolle in einem Multi-Agenten-System übernehmen kann, insbesondere: ein natürliches Sprachziel entgegennehmen, es in einen Aufgabenplan zerlegen, Agenten zuweisen, Werkzeuge aufrufen und Ergebnisse zusammenfügen.

Technische Umsetzung

Das verwendete Framework war open-multi-agent (TypeScript, Open-Source) mit Ollama über eine OpenAI-kompatible API. Der Koordinator erhält ein Ziel und eine Agentenliste und gibt dann ein JSON-Aufgabenarray mit Titel, Beschreibung, Zuständigem und Abhängigkeiten aus. Agenten führen mit Werkzeugaufruffähigkeiten aus, einschließlich bash- und Datei-Lese-/Schreiboperationen.

Modell-Details

Gemma 4 E2B („Effective 2B“) hat 2,3 Milliarden effektive Parameter und 5,1 Milliarden Gesamtparameter. Die zusätzlichen ~2,8 Milliarden Parameter sind für die Embedding-Schicht, die 140+ Sprachen und multimodale Fähigkeiten unterstützt.

Testszenario

Das vorgegebene Ziel war: „Überprüfe die Node.js-Version, die npm-Version und die OS-Informationen dieses Rechners, dann schreibe einen kurzen Markdown-Zusammenfassungsbericht nach /tmp/report.md“

E2B hat korrekt:

  • Es in 2 Aufgaben mit einer Abhängigkeit zerlegt (Forscher → Zusammenfasser)
  • Jede dem richtigen Agenten zugewiesen
  • Bash verwendet, um Systembefehle auszuführen
  • file_write verwendet, um den Bericht zu speichern
  • Die endgültige Ausgabe synthetisiert

Sowohl runTasks() (explizite Pipeline) als auch runTeam() (Modell plant alles autonom) funktionierten.

Ad

Leistung und Beobachtungen

Auf einem M1 mit 16 GB RAM:

  • Vollständiges runTeam() dauert ~2 Minuten
  • 6–9 sequenzielle LLM-Aufrufe im Hintergrund (Koordinatorplanung → Forscher-Mehrfach-Werkzeugnutzung → Zusammenfasser → Koordinatorsynthese)
  • ~10–15 Sekunden pro Aufruf auf M1
  • E2B verwendet ~3–4 GB RAM ohne Speicherdruck

Was gut funktionierte:

  • JSON-Ausgabe: Der Koordinator erzeugte das korrekte Schema für die Aufgabenzerlegung. Das Framework hat eine tolerante Analyse, die zuerst umrahmte Blöcke versucht und dann auf die Extraktion nackter Arrays zurückfällt.
  • Werkzeugaufruf: Funktioniert über den OpenAI-kompatiblen Endpunkt, entscheidet korrekt, wann aufgerufen werden soll, analysiert Argumente und verarbeitet Mehrfach-Ergebnisse.

Festgestellte Einschränkungen:

  • Ausgabequalität: Die Prosa in der endgültigen Synthese ist deutlich schwächer als bei größeren Modellen. Funktional, aber nicht ausgefeilt.

Reproduktionsschritte

ollama pull gemma4:e2b
git clone https://github.com/JackChen-me/open-multi-agent
cd open-multi-agent && npm install
no_proxy=localhost npx tsx examples/08-gemma4-local.ts

Die Testdatei ist ~190 Zeilen unter examples/08-gemma4-local.ts. Die Einstellung no_proxy=localhost ist nur erforderlich, wenn ein HTTP-Proxy konfiguriert ist.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Kuratiere Liste von 260+ KI-Agenten und Tools mit Fokus auf Open-Source und Self-Hosting
Werkzeuge

Kuratiere Liste von 260+ KI-Agenten und Tools mit Fokus auf Open-Source und Self-Hosting

Ein umfassendes GitHub-Repository listet über 260 KI-Agenten und -Frameworks auf und betont dabei Open-Source-, selbst gehostete und lokale Optionen wie Ollama, OpenClaw und DeerFlow.

OpenClawRadar
Vereinfachung der Automatisierung mit OpenClaw-Wrappern
Werkzeuge

Vereinfachung der Automatisierung mit OpenClaw-Wrappern

OpenClaw Wrappers bieten eine effiziente Möglichkeit, AI-Coding-Agenten zu verwalten. Entdecken Sie, wie diese Tools sich mühelos in bestehende Frameworks integrieren lassen, einschließlich spezifischer Beispielbefehle und Feedback aus der Community.

OpenClawRadar
Der Engpass bei parallelen KI-Agenten: Warteschlange für menschliche Genehmigung
Werkzeuge

Der Engpass bei parallelen KI-Agenten: Warteschlange für menschliche Genehmigung

Ein Entwickler, der parallele Claude Code Agents betreibt, beschreibt den 'Bottleself' – den Punkt, an dem Parallelität keine zusätzliche Ausgabe mehr erzeugt, sondern einen Rückstau an menschlichen Freigaben verursacht. Seine Lösung: ein Planer, der Ziele in Teilaufgaben zerlegt, Agents startet und nur bei ungelösten Entscheidungen nachfragt.

OpenClawRadar
Claude Agent Teams UI: Desktop-App zur Visualisierung von Claude-Code-Agent-Workflows
Werkzeuge

Claude Agent Teams UI: Desktop-App zur Visualisierung von Claude-Code-Agent-Workflows

Ein Entwickler hat eine kostenlose, quelloffene Desktop-App erstellt, die eine visuelle Ebene zur experimentellen Agent Teams-Funktion von Claude Code hinzufügt. Die App bietet ein Echtzeit-Kanban-Board, auf dem sich Aufgaben automatisch bewegen, während Agenten arbeiten, plus teamübergreifende Kommunikation, integrierte Review-Workflows und Code-Reviews pro Aufgabe.

OpenClawRadar