Qwen3.5-35B-A3B-UD-Q6_K_XL in Produktionsentwicklungsworkflows getestet

Ein Entwickler auf r/LocalLLaMA teilte detaillierte Testergebnisse des Qwen3.5-35B-A3B-UD-Q6_K_XL-Modells in Produktionsentwicklungsszenarien. Der Nutzer führte sowohl Benchmark-Tests als auch praktische Anwendungen über reale Kundenprojekte hinweg durch.
Leistungsbenchmarks
Das Modell erzielte Benchmark-Werte von 1504pp2048 und 47,71 tg256. Die Token-Generierungsgeschwindigkeit war solide, wenn sie auf zwei GPUs verteilt wurde, und stieg auf 80 Token pro Sekunde (tps), wenn es auf einer einzelnen GPU lief.
Produktionstestmethodik
Der Entwickler testete das Modell über fünf verschiedene Projekte hinweg und verwendete Git Worktrees, um zu bekannten Spezifikationen und Funktionen zurückzukehren. Die Spezifikationen für diese Tests wurden von Claude generiert, wobei der Entwickler seit einem Jahr einen Max Pro Plan nutzt.
- Getestet über JavaScript-, Go- und Rust-Projekte hinweg
- Verwendete Git Worktrees für die Versionskontrolle während der Tests
- Die meisten "Fehler" erforderten nur 5-minütige Anpassungen oder konnten mit einer zweiten Eingabeaufforderung behoben werden
- Verglich die Erfahrung mit der Nutzung von Sonnet 4
Praktische Ergebnisse und geschäftliche Auswirkungen
Der Entwickler berichtete, dass Qwen3.5 für die von ihm durchgeführte Arbeit "herausragend" abschnitt, wobei besonders die starke Leistung bei Go- und Rust-Projekten hervorgehoben wurde. Dies hat zu ernsthaften Überlegungen geführt, von API-basierten Modellen zu einem hybriden Ansatz zu wechseln: Nutzung von SOTA-Modellen über APIs für Spezifikationsgenerierung und Reviews, während lokale Modelle für Entwicklungsarbeiten eingesetzt werden.
Die Tests haben Fragen zu Hardware-Investitionen versus Abonnementkosten aufgeworfen. Der Entwickler hat seit Juni 2025 bereits 2.000 US-Dollar für Claude Pro Max ausgegeben, wobei die potenziellen Kosten bis 2027 auf 6.800 US-Dollar steigen könnten, wenn die Abonnements fortgesetzt werden. Dies hat zu Überlegungen geführt, eine RTX 6000 Pro als Geschäftsinvestition zu kaufen.
Der Entwickler hatte zuvor Qwen Coder für Tab-Vervollständigung genutzt, fand jedoch, dass Qwen3.5 die Fähigkeiten lokaler Modelle für den Produktionseinsatz auf ein neues Niveau hebt.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude Desktop App Cowork-Funktion ermöglicht KI-zu-KI-Kommunikation über gemeinsame Google Docs
Benutzer haben erfolgreich eine Claude-zu-Claude-Kommunikation mithilfe der neuen Cowork-Funktion in der Desktop-App implementiert, wobei zwei KI-Agenten in einem strukturierten Fünf-Austausch-Dialog ein gemeinsames Google Doc lesen und darin schreiben.

„Gefundene-Probleme“-Plugin protokolliert Fehler, die Claude bei anderen Aufgaben ignoriert
Ein Claude Code Plugin, das einzeilige Einträge in docs/found-issues.md schreibt, wenn der Agent Bugs außerhalb des Aufgabenbereichs entdeckt, mit automatischer Schließung bei PR-Merge und Tombstone-Erkennung.

gui.new: Tool für Claude, um visuelle Ausgaben als teilbare Links darzustellen
gui.new ist ein Tool, mit dem Claude visuelle Ausgaben als live teilbare Links rendern kann, anstatt Codeblöcke zurückzugeben. Es wurde mit Claude erstellt, nutzt Next.js auf Vercel mit Supabase und erfordert keine Anmeldung.

Claude-Nutzungsmonitor: Schwimmendes CRT-Widget für Windows
Ein Entwickler hat ein Windows-Widget erstellt, das die Claude-API-Nutzung in Echtzeit mit Sitzungs- und Wochenbalken anzeigt und sieben Farbthemen sowie automatisches Pausieren bei gesperrtem Bildschirm oder Vollbildmodus bietet.