Qwen3.6:27b + Custom Go-Agent: Eine lokale Alternative zu Claude Code

Ein Entwickler (codehamr), der ein Geschäft mit lokalen LLM-Integrationen betreibt, beschreibt Experimente mit lokalen Modellen als Fallback für Claude Code. Er berichtet, dass Qwen3.6:27b bei Q8 auf einer RTX 6000 mit 96 GB und 128k Kontext eine ähnliche Programmiererfahrung wie Claude Code bietet, und stellt fest, dass eine Consumer-RTX 5090 mit 32 GB bei Q4_M vergleichbare Ergebnisse erzielen kann.
Für die Agentenebene hat er ein minimales, einzelnes Go-Binary namens codehamr (MIT Open Source) erstellt – keine Plugins, kein MCP, keine Themes. Der Agent erledigt Suche, Abhängigkeiten und Dateiarbeiten über Bash bei Bedarf. Das Repository ist verfügbar unter: https://github.com/codehamr/codehamr
Wichtige Details
- Modell: Qwen3.6:27b bei Q8-Quantisierung, läuft auf RTX 6000 (96 GB) mit 128k Kontext – überdimensioniert für ein 30B-Modell.
- Consumer-Alternative: RTX 5090 (32 GB) bei Q4_M sollte mit guter Prompt-Disziplin eine ähnliche Programmiererfahrung bieten.
- Agent-Build: Benutzerdefiniertes Go-Binary – minimal, keine Plugins, kein MCP. Verwendet Bash für Suche, Abhängigkeiten, Dateioperationen.
- Lizenz: MIT Open Source, zum Forken oder Ignorieren verfügbar.
Der Entwickler betont, dass jeder Schritt in Richtung lokaler LLMs die Abhängigkeit von Cloud-Tools reduziert. Dieses Setup ist in Kombination mit disziplinierter Prompt-Gestaltung die erste lokale Konfiguration, bei der er Claude Code nicht vermisst.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

OpenClaw React Client Update fügt Modell pro Agent, CLI-Tool und Auto-Start hinzu
Der Open-Source-OpenClaw-Client hat ein großes Update mit vier wichtigen Funktionen erhalten: Modellzuweisung pro Agent, automatische Updates, ein neues CLI-Tool zur Verwaltung und automatischer Start nach Systemneustart.

Entwicklung einer Programmiersprache mit Claude Code: Das Cutlet-Experiment
Ankur Sethi entwickelte in vier Wochen eine vollständige Programmiersprache namens Cutlet mithilfe von Claude Code, wobei die KI jede Codezeile generierte, während er sich auf Sicherheitsvorkehrungen und Tests konzentrierte. Die Sprache bietet dynamische Typisierung, vektorisierte Operationen und eine REPL und läuft auf macOS und Linux.

Analyse der wiederverwendbaren Go-Komponenten von Ollama für die lokale LLM-Entwicklung
Ein Entwickler untersuchte den Quellcode von Ollama und fand mehrere eigenständige Go-Komponenten, darunter einen reinen Go-Token-Sampler, GGUF-Lese-/Schreibfunktionen, Modellkonvertierungswerkzeuge, Chat-Vorlagen-Rendering und OpenAI-Kompatibilitätstransformationen, die nicht als separate Bibliotheken verfügbar sind.

ETL-D MCP-Server: Deterministisches CSV-Parsing für Claude zur Vermeidung finanzieller Halluzinationen
Ein Entwickler hat ETL-D erstellt, einen Open-Source-MCP-Server für Claude Desktop, der CSVs in drei deterministischen Schichten verarbeitet, um Halluzinationen von Dezimalpunkten in Finanzdaten zu verhindern. Er verwendet Python-Parser für bekannte Formate, erreicht ~70ms Antwortzeiten mit 0 LLM-Aufrufen für 200 parallele Anfragen und nutzt LLMs nur als Fallback für hochgradig unvorhersehbaren Text.