Entwickler wechselt von Cursor Composer 2 und Kimi 2.6 zu Qwen3.6:35b-a3b für Unternehmensworkloads

Ein Entwickler auf r/LocalLLaMA berichtet, dass er Cursor Composer 2 und Kimi 2.6 erfolgreich durch Qwen3.6:35b-a3b für die tägliche Softwareentwicklung an einer Unternehmenscodebasis mit 500.000–700.000 Zeilen (60 Stunden/Woche) ersetzt hat. Der Nutzer hatte zuvor Kimi 2.6 und DeepSeek 4 Pro/Flash ausprobiert, fand aber Qwen3.6:35b-a3b am besten geeignet.
Wichtige Details
- Modell: Qwen3.6:35b-a3b (die 3.6-Version mit 35 Mrd. Parametern und einem 3 Mrd. aktivierten Subset via MoE? – die Notation des Nutzers ist mehrdeutig; vermutlich Qwen2.5-32B oder eine benutzerdefinierte Variante). Das Modell unterstützt Bild-/Screenshot-Eingabe.
- Hosting: Ausgeführt über OpenRouter zu etwa 0,08 $ pro 1 Mio. Tokens im Durchschnitt nach Cache- und Abrechnungsanpassungen. Dem Nutzer fehlt die Hardware für lokale Inferenz.
- Arbeitslast: Vollzeitentwicklung an einer großen Unternehmenssoftware-Suite. Der Nutzer behauptet, das Modell „verstehe“ die Codebasis und den Aufgabenkontext tatsächlich und übertreffe frühere Optionen.
- Fehlende Funktion: Der einzige Nachteil ist das Fehlen der Cloud Agents-Funktionalität von Cursor und des hohen Durchsatzes von Composer 2.
Kostenvergleich
Mit ~0,08 $/1 Mio. Tokens wird Qwen3.6:35b-a3b als „unglaublich günstig“ für sein Leistungsniveau beschrieben. Eine genaue Aufschlüsselung wird nicht gegeben, aber Cache- und Nutzungsrabatte kommen zum Tragen.
Für wen es geeignet ist
Entwickler, die mit großen proprietären Codebasen arbeiten und ein leistungsfähiges, kostengünstiges Modell für KI-gestützte Programmierung wünschen, ohne lokale GPU-Hardware zu benötigen.
📖 Lesen Sie die vollständige Quelle: r/LocalLLaMA
👀 Siehe auch

Claude Code v2.1.198: Chrome GA, Agent-Benachrichtigungen, /dataviz und AWS Gateway
Anthropic hat Claude Code v2.1.198 mit Chrome-Erweiterung GA, Hintergrund-Agenten-Benachrichtigungen, einer neuen /dataviz-Fähigkeit und Claude Platform on AWS als Failover-Provider veröffentlicht.

Tencent veranstaltet in Shenzhen kostenlose OpenClaw-Installationsevents angesichts hoher Nachfrage
Tencent organisierte am 6. März 20 Mitarbeiter außerhalb seines Bürogebäudes in Shenzhen, um OpenClaw kostenlos zu installieren, nachdem Berichte über Personen aufgetaucht waren, die mehr als 70 US-Dollar für Hausbesuchs-Installationsdienste bezahlten. Die Veranstaltung nutzte Tencent Clouds Lighthouse-Plattform, wobei die meisten Teilnehmer weiße Kragen waren, die mit Arbeitsplatzkonkurrenz und KI-Anpassungsdruck konfrontiert waren.

GLM-5.1 veröffentlicht mit Programmierleistung auf dem Niveau von Claude Opus 4.5
Zhipu AIs GLM-5.1-Modell ist jetzt für alle Coding Plan-Nutzer verfügbar und erreicht 77,8 Punkte auf SWE-bench-Verified und 56,2 Punkte auf Terminal Bench 2.0. Das Modell verfügt über ein 200K-Kontextfenster, eine maximale Ausgabe von 128K und 744B Parameter mit 40B aktivierten.

Anthropic reagiert auf Code-Leak im Zusammenhang mit Claude-KI-Agenten
Anthropic arbeitet daran, ein Leck von Code im Zusammenhang mit seinem Claude-KI-Agenten einzudämmen, wie ein WSJ-Bericht besagt, der auf Hacker News mit 13 Punkten und 6 Kommentaren diskutiert wurde.