Lokale LLM-Leistungsbenchmarks auf dem Mac Mini mit OpenClaw und LM Studio

Ein Reddit-Nutzer teilte konkrete Leistungsbenchmarks für das lokale Ausführen eines großen Sprachmodells auf einem Mac Mini mit 32 GB RAM mit. Der Beitrag befasst sich mit der Knappheit spezifischer Leistungsdaten für diese Hardwarekonfiguration.
Details zum technischen Setup
Der Nutzer berichtete über die folgende Konfiguration und Ergebnisse:
- Softwareversionen: OpenClaw 2026.3.8, LM Studio 0.4.6+1
- Modell: Unsloth gpt-oss-20b-Q4_K_S.gguf
- Kontextgröße: 26035
- Leistungsmetriken: 34 Token/Sekunde nach der ersten Eingabeaufforderung, 0,7 Sekunden Zeit bis zum ersten Token
Modellkonfiguration
Der Nutzer gab diese Modelleinstellungen an (alle auf Standardwerten):
- GPU-Auslagerung = 18
- CPU-Thread-Pool-Größe = 7
- Maximale gleichzeitige Vorgänge = 4
- Anzahl der Experten = 4
- Flash-Aufmerksamkeit = an
Die Q4_K_S-Quantisierung zeigt an, dass es sich um eine 4-Bit-quantisierte Version des 20-Milliarden-Parameter-Modells handelt, die den Speicherbedarf reduziert und gleichzeitig eine angemessene Leistung beibehält. Der 32-GB-RAM des Mac Mini ist für diese Modellgröße mit der angegebenen Kontextlänge ausreichend. Der Durchsatz von 34 Token/Sekunde ist ein praktischer Benchmark für Entwickler, die ähnliche lokale LLM-Setups auf Apple-Silicon-Hardware in Betracht ziehen.
📖 Read the full source: r/openclaw
👀 Siehe auch

Agent Forge: Open-Source-Tool erstellt Gerüste für Multi-Agent-Pipelines für Claude Code
Agent Forge ist eine Claude Code-Fähigkeit, die vollständige Multi-Agenten-Pipelines aus Anwendungsfallbeschreibungen generiert. Es erstellt Prompt-Dateien, Orchestrator-Skripte, Datenflussverzeichnisse und GitHub Actions-Konfigurationen basierend auf Mustern, die in bestehenden Multi-Agenten-Systemen beobachtet wurden.

Pretticlaw: Eine leichtere Alternative zu OpenClaw mit schnellerer Einrichtung
Pretticlaw ist eine leichte Alternative zu OpenClaw, die nur 2 Befehle für die Einrichtung benötigt, einen Speicherbedarf von 30 MB hat, in 2-3 Sekunden antwortet und ein integriertes Dashboard auf Port 6767 bietet.

ClawsifyAI-Agent bearbeitet E-Mail-, Recherche- und Brainstorming-Aufgaben
Ein Entwickler testete ClawsifyAI, einen KI-Agenten im Stil einer Greifarm-Maschine, eine Woche lang und stellte fest, dass es E-Mails, Recherche, repetitive Arbeiten und Brainstorming bewältigte. Der Agent liefert klare Rückmeldungen, praktische Lösungen und manchmal sogar bessere Ideen als ursprünglich geplant.

yoyo: Lokaler MCP-Server für fundierte Codebase-Lektüre und geschützte Schreibvorgänge mit Claude Code
yoyo ist ein Open-Source-Local-MCP-Server, der Coding-Agenten wie Claude Code mit fundierten Repository-Lesevorgängen und geschützten Schreibvorgängen in 16 Sprachen ermöglicht, darunter Rust, Go, Python und TypeScript. Er verhindert, dass fehlerhafte Änderungen unbemerkt übernommen werden, indem er maschinenlesbare guard_failure-Ausgaben zurückgibt und retry_plan für gezielte Reparaturen ermöglicht.