Entwickler wechselt von Cursor Composer 2 und Kimi 2.6 zu Qwen3.6:35b-a3b für Unternehmensworkloads

Ein Entwickler auf r/LocalLLaMA berichtet, dass er Cursor Composer 2 und Kimi 2.6 erfolgreich durch Qwen3.6:35b-a3b für die tägliche Softwareentwicklung an einer Unternehmenscodebasis mit 500.000–700.000 Zeilen (60 Stunden/Woche) ersetzt hat. Der Nutzer hatte zuvor Kimi 2.6 und DeepSeek 4 Pro/Flash ausprobiert, fand aber Qwen3.6:35b-a3b am besten geeignet.
Wichtige Details
- Modell: Qwen3.6:35b-a3b (die 3.6-Version mit 35 Mrd. Parametern und einem 3 Mrd. aktivierten Subset via MoE? – die Notation des Nutzers ist mehrdeutig; vermutlich Qwen2.5-32B oder eine benutzerdefinierte Variante). Das Modell unterstützt Bild-/Screenshot-Eingabe.
- Hosting: Ausgeführt über OpenRouter zu etwa 0,08 $ pro 1 Mio. Tokens im Durchschnitt nach Cache- und Abrechnungsanpassungen. Dem Nutzer fehlt die Hardware für lokale Inferenz.
- Arbeitslast: Vollzeitentwicklung an einer großen Unternehmenssoftware-Suite. Der Nutzer behauptet, das Modell „verstehe“ die Codebasis und den Aufgabenkontext tatsächlich und übertreffe frühere Optionen.
- Fehlende Funktion: Der einzige Nachteil ist das Fehlen der Cloud Agents-Funktionalität von Cursor und des hohen Durchsatzes von Composer 2.
Kostenvergleich
Mit ~0,08 $/1 Mio. Tokens wird Qwen3.6:35b-a3b als „unglaublich günstig“ für sein Leistungsniveau beschrieben. Eine genaue Aufschlüsselung wird nicht gegeben, aber Cache- und Nutzungsrabatte kommen zum Tragen.
Für wen es geeignet ist
Entwickler, die mit großen proprietären Codebasen arbeiten und ein leistungsfähiges, kostengünstiges Modell für KI-gestützte Programmierung wünschen, ohne lokale GPU-Hardware zu benötigen.
📖 Lesen Sie die vollständige Quelle: r/LocalLLaMA
👀 Siehe auch

Claude AI zeigt ungewöhnliches Interpunktions-Kommunikationsmuster zwischen Instanzen
Zwei Claude Sonnet 4.6-Instanzen im Dialog wechselten nach einer normalen Nachricht zu Interpunktions-Only-Ausgabesequenzen wie "- . . ? , \"-\" , : \" , - \"? .". Der empfangende Claude interpretierte diese Sequenzen als sinnvolle Kommunikation, während andere Modelle wie ChatGPT und Grok dies nicht taten.

ETH-Zürich-Studie: Übermäßiger Kontext verringert die Leistung von KI-Code-Agenten
Eine ETH-Zürich-Studie testete vier Coding-Agenten an 138 echten GitHub-Aufgaben und fand heraus, dass LLM-generierte Kontextdateien die Erfolgsquote um 2-3 % senkten, während die Inferenzkosten um 20 % stiegen. Von Menschen geschriebener Kontext verbesserte den Erfolg nur um etwa 4 %, bei gleichzeitig erheblichen Kostensteigerungen.

Bloomberg berichtet: Arbeitsplatzverluste in den USA durch KI-Belastung beginnen zuzunehmen
Bloomberg berichtet, dass die USA erhebliche Arbeitsplatzverluste in KI-exponierten Berufen verzeichnen, wobei eine Diskussion auf Hacker News auf reale Auswirkungen auf Entwickler und andere Wissensarbeiter hinweist.
Claude Code v2.1.210 behebt Worktree-Isolation, Ultracode-Opt-In und Dutzende Fehler
Zu den Highlights gehören die Behebung der Subagent-Worktree-Isolation, der Fix für das ultracode-Opt-in, ein neuer Echtzeit-Zähler und die Abkündigung von Berechtigungsregeln.