Entwickler testet Qwen3.5 27B im Vergleich zu größeren Modellen für lokale Programmieraufgaben

✍️ OpenClawRadar📅 Veröffentlicht: 28. März 2026🔗 Source
Entwickler testet Qwen3.5 27B im Vergleich zu größeren Modellen für lokale Programmieraufgaben
Ad

Ein Entwickler testete mehrere große Sprachmodelle für lokale Programmieraufgaben und verglich Leistung und Hardwareanforderungen. Der Test konzentrierte sich auf Qwen3.5-Varianten und Nemotron-Modelle, mit Vergleichen zu GPT-5.4 High.

Testergebnisse und Erkenntnisse

Der Entwickler testete diese spezifischen Modelle:

  • unsloth/Qwen3.5-27B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL
  • unsloth/Qwen3.5-122B-A10B-GGUF
  • unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL
  • unsloth/Qwen3.5-27B-GGUF:UD-Q8_K_XL
  • unsloth/NVIDIA-Nemotron-3-Super-120B-A12B-GGUF:UD-IQ4_XS
  • unsloth/gpt-oss-120b-GGUF:F16

Wichtige Erkenntnisse aus dem Test:

  • Nemotron-3-Super-120B schnitt "sehr, sehr gut" ab, auf Augenhöhe mit GPT-5.4 High
  • Qwen3.5-27B eignete sich gut für Entwicklungsaufgaben
  • GPT-OSS-120B und Qwen3.5-122B schnitten schlechter ab als die beiden anderen Modelle
  • Nemotron-3-Super-120B antwortete durchgehend auf Spanisch (die Muttersprache des Testers), während andere auf Englisch antworteten

Leistungsmetriken

Der Entwickler lieferte spezifische Leistungszahlen:

  • Nemotron-3-Super-120B: 80 Token pro Sekunde (tg/s), ~2000 Prompt-Verarbeitung (pp), 100k Kontext auf vast.ai mit 4x RTX 3090
  • Qwen3.5-27B Q6: 803 pp, 25 tg/s, 256k Kontext auf vast.ai
Ad

Hardwareanforderungen

Der Entwickler stellte Hardwareeinschränkungen fest:

  • Qwen3.5-122B würde ein neues Mainboard und 1-2 weitere RTX 3090-Karten erfordern, was zu teuer wäre
  • Qwen3.5-27B läuft auf bestehender 2x RTX 3090-Hardware ohne zusätzliche Investition
  • Wenn sie die Hardware für Nemotron-3-Super-120B hätten, würden sie diese stattdessen verwenden

Implementierungsdetails

Der Entwickler plant, Qwen3.5-27B-GGUF:UD-Q6_K_XL für echte Entwicklungsaufgaben lokal zu nutzen, und gab den für den Test verwendeten llama.cpp-Befehl an:

./llama.cpp/llama-server -hf unsloth/Qwen3.5-27B-GGUF:UD-Q6_K_XL --ctx-size 262144 --temp 0.6 --top-p 0.95 --top-k 20 --min-p 0.00 -ngl 999

Der Entwickler erwähnte, dass sie CODEX für komplexe Aufgaben weiterhin nutzen werden, aber API-Abonnements für tägliche Aufgaben durch das lokale Setup ersetzen können.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Via Open Source Universal Integration Layer verbindet KI-Tools mit einem gemeinsamen Kontextbus
Werkzeuge

Via Open Source Universal Integration Layer verbindet KI-Tools mit einem gemeinsamen Kontextbus

Via ist eine quelloffene universelle Integrationsschicht, die Claude, Cursor, Windsurf, ChatGPT, LangChain und andere KI-Tools mit einem gemeinsamen Kontext-, Aufgaben- und Speicherbus verbindet, sodass Arbeit den Benutzern über Tools, Sitzungen und Maschinen hinweg folgen kann.

OpenClawRadar
Claude Plugins: Computer Vision, Multi-Agent Council und Self-Debugging Workflow
Werkzeuge

Claude Plugins: Computer Vision, Multi-Agent Council und Self-Debugging Workflow

Drei Claude-Plugins wurden veröffentlicht: Computer Vision v1.7.0 für die Automatisierung von Windows-Apps, The Council v3.1.0 für konsultative Mehr-Agenten-Beratung und Upwork Scraper v0.2.0 für die Analyse des Arbeitsmarktes. Eine Demonstration zeigte, wie Claude diese Plugins nutzte, um seinen eigenen Solitaire-Automatisierungsfehler zu diagnostizieren und zu beheben.

OpenClawRadar
OpenObscure: Open-Source On-Device Privacy Firewall für KI-Agenten
Werkzeuge

OpenObscure: Open-Source On-Device Privacy Firewall für KI-Agenten

OpenObscure ist eine Open-Source, On-Device-Datenschutz-Firewall für KI-Agenten, die zwischen Ihrem KI-Agenten und dem LLM-Anbieter sitzt. Sie verwendet FF1-Format-Preserving Encryption, um PII-Werte zu verschlüsseln, bevor Anfragen Ihr Gerät verlassen. Sie umfasst PII-Erkennung mit 99,7% Recall, kognitive Firewall-Scans und läuft auf macOS/Linux/Windows mit iOS/Android-Bindings.

OpenClawRadar
Yavio: Open-Source Product Analytics SDK für MCP-Apps
Werkzeuge

Yavio: Open-Source Product Analytics SDK für MCP-Apps

Yavio ist ein Open-Source-Produktanalyse-SDK für MCP und MCP-Apps, das mit einem Funktionsaufruf automatisch Tool-Aufrufe, Fehler und Ressourcenzugriffe erfasst. Das MIT-lizenzierte Projekt bietet ein Dashboard mit Aufschlüsselungen pro Tool, Funnels, Retention und Fehlerverfolgung.

OpenClawRadar