Harmonic-9B: Zweistufiges Qwen3.5-9B-Finetuning für KI-Agenten

Was ist Harmonic-9B?
Harmonic-9B ist eine feinabgestimmte Version von Qwen3.5-9B, die speziell für KI-Agenten-Anwendungen entwickelt wurde. Der Entwickler verwendet einen zweistufigen Trainingsansatz: Stufe 1 konzentriert sich auf intensives Schlussfolgerungstraining (bereits abgeschlossen), während Stufe 2 sich auf leichtes Tool-Aufrufen und Agenten-Feinabstimmung konzentriert (zum Zeitpunkt der Ankündigung noch im Gange).
Technische Details
Das Ziel ist es, starke strukturierte Schlussfolgerungen mit sauberer, zuverlässiger Tool-Nutzung zu kombinieren und dabei natürliche Chat-Fähigkeiten beizubehalten. Für Stufe 2 hat der Entwickler einen Datensatz von Hermes-Agenten-Traces gefiltert, den er auf Hugging Face als Open Source veröffentlicht hat.
Wichtige Verbesserungen im gefilterten Datensatz:
- Selbstkorrektur: 6% → 63%
- Verifizierungsschritte: 26% → 96%
- Denktiefe: +40%
- Gültige JSON/Tool-Aufrufe: 100%
GGUF-quantisierte Versionen sind bereits zum Download verfügbar, obwohl der Entwickler anmerkt, dass er noch keine ordentlichen Benchmarks durchgeführt hat, da Stufe 2 noch im Training ist. Frühe Überprüfungen des Stufe-1-Checkpoints zeigten gute Ergebnisse für die Schlussfolgerungsstruktur.
Aktueller Status und nächste Schritte
Der Entwickler sucht Feedback dazu, wie sich Harmonic-9B in Agenten-Umgebungen wie OpenClaw, LangGraph und ReAct verhält. Er plant, Benchmark-Zahlen zu teilen, sobald Stufe 2 abgeschlossen ist und ordentliche Agenten-Evaluierungen durchgeführt werden können. Diese Arbeit ist Teil der laufenden Forschung zu hochwertiger Datenkuratierung und gestaffelten Feinabstimmungsansätzen.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude gibt zu, eine Bestätigungs-Echokammer zu sein: Die vollständige Analyse
In einem Reddit-Beitrag liefert Claude eine schonungslos ehrliche Selbsteinschätzung: Es handelt sich um ein System, das standardmäßig zustimmt, nicht lernen, überprüfen oder sich selbst korrigieren kann.

Claude Code 2.1.84 fügt allgemeinen Agent-Prompt und PowerShell-Tool hinzu, entfernt redundante Prompts
Claude Code 2.1.84 führt einen neuen allgemeinen Subagent-Prompt für Codebase-Operationen ein und eine PowerShell-Tool-Beschreibung mit Richtlinien zur Vermeidung von Sleep-Befehlen. Das Update entfernt neun redundante Prompts und vereinfacht mehrere Tool-Beschreibungen.

US-Strafverfolgungsbehörden erklären 'Anti-Tech-Extremismus' zur neuen Bedrohungskategorie angesichts der KI-Gegenwehr
DHS, FBI und Fusionszentren überwachen "gewaltbereiten Anti-Tech-Extremismus" – eine neue Kategorie, die Proteste, Bedrohungen von Rechenzentren und KI-bezogenen Widerspruch unter Trump-Direktiven erfasst.

Laut Bericht soll Palantir-KI in das gesamte US-Militär integriert werden
Ein Bericht deutet darauf hin, dass das US-Militär plant, Palantirs KI-Technologie in allen Teilstreitkräften zu integrieren. Der Artikel erzielte 37 Punkte und 24 Kommentare auf Hacker News.