DeepSeek v4 Flash auf Mac Studio: Lokales LLM findet echte Fehler im Compiler-Code

Ein Entwickler, der am tsz.dev Compiler-Projekt arbeitet, berichtet, dass der lokale Betrieb von DeepSeek v4 Flash auf einem 128GB Mac Studio nun in der Lage ist, echte Fehler in der komplexen Codebasis zu finden – eine Aufgabe, die vor nur fünf Monaten noch Claude (cloudbasiert) erforderte.
Hardware & Setup
- Maschine: 128GB Mac Studio
- Modell: DeepSeek v4 Flash
- Wrapper:
pi-ds4– ein leichter Python-Wrapper von mitsuhiko auf GitHub
Workflow-Details
Der Benutzer wies das lokale Modell an, Fehler in seinem Compiler-Code zu finden. Das Modell produzierte eine Reihe von gemeldeten Problemen, die der Benutzer als echte Fehler bestätigte (keine Halluzinationen). Derzeit behebt er diese Fehler mit Claude und GPT (Bezahlkonten). Der Benutzer merkt an: „Es hat viele Fehler erzeugt, die tatsächlich gültig zu sein scheinen“ – was bedeutet, dass die Ausgaben des Modells umsetzbar sind.
Der Entwickler startete das Projekt am 1. Januar 2026 mit derselben Hardware, aber zu diesem Zeitpunkt waren lokale LLMs zu fehleranfällig, weshalb er auf Claude angewiesen war. Die Verbesserung in fünf Monaten wird als dramatisch beschrieben: Lokale Inferenz liefert nun qualitativ hochwertige Ergebnisse für eine schwierige Codebasis, ohne dass Cloud-Abonnements erforderlich sind.
Fazit
Dies ist eine reale Validierung, dass lokale LLMs – insbesondere DeepSeek v4 Flash auf relativ bescheidener Consumer-Hardware (128GB RAM) – jetzt spezialisierte Aufgaben wie Compiler-Fehlererkennung bewältigen können. Der Entwickler spekuliert, dass mit 512GB RAM die Leistung noch besser wäre, was darauf hindeutet, dass größere Modelle oder schnellere Inferenz die Lücke zu Cloud-APIs weiter schließen könnten.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude CLI-Richtlinienabweichungsproblem von Entwickler gemeldet
Ein Entwickler berichtet, dass Claude CLI konsequent Projektrichtlinien ignoriert, die in Dateien des .claude-Ordners gespeichert sind, insbesondere nach automatischen Komprimierungsvorgängen. Das Tool führt verbotene Hintergrundprozesse aus und löscht Aufgaben-/Sitzungsdaten trotz ausdrücklicher Anweisungen.

FFmpeg-Entwickler beschuldigt OxideAV der KI-Lizenzwäsche im MagicYUV-Problem
Ein FFmpeg-Entwickler hat im magicyuv-Repository von OxideAV ein Issue eröffnet, das die Lizenzierung des Projekts in Frage stellt und KI-gestütztes Lizenz-Laundering von GPL-Code vermutet.

Anthropic kehrt Politik zu Drittanbieter-Agent-SDK und claude-p um, senkt effektiven Inferenzwert für Max-Abonnenten um das 25- bis 40-fache
Anthropic hat sein Verbot von Drittanbieter-Agenten, die Abonnement-Anmeldedaten verwenden, aufgehoben, jedoch wurden claude-p und das Agent SDK in einen separaten, nicht übertragbaren Guthabenpool verschoben, der zu API-Preisen abgerechnet wird, was den effektiven Inferenzwert für Max-Abonnenten um das 25- bis 40-fache reduziert.

Analyse der Astroturfing-Kampagne von OpenClaw und des $CLAWD Token Pumps
Eine Reddit-Untersuchung enthüllt, dass das virale Wachstum von OpenClaw Ende Januar durch eine rekursive Astroturfing-Kampagne mit etwa 400 Bot-Instanzen angetrieben wurde, die Hype erzeugte, um den $CLAWD-Token auf eine Marktkapitalisierung von 16 Millionen US-Dollar zu treiben, bevor er um 90 % abstürzte.