Lokale LLM-Leistungsbenchmarks auf dem Mac Mini mit OpenClaw und LM Studio

✍️ OpenClawRadar📅 Veröffentlicht: 18. April 2026🔗 Source
Lokale LLM-Leistungsbenchmarks auf dem Mac Mini mit OpenClaw und LM Studio
Ad

Ein Reddit-Nutzer teilte konkrete Leistungsbenchmarks für das lokale Ausführen eines großen Sprachmodells auf einem Mac Mini mit 32 GB RAM mit. Der Beitrag befasst sich mit der Knappheit spezifischer Leistungsdaten für diese Hardwarekonfiguration.

Details zum technischen Setup

Der Nutzer berichtete über die folgende Konfiguration und Ergebnisse:

  • Softwareversionen: OpenClaw 2026.3.8, LM Studio 0.4.6+1
  • Modell: Unsloth gpt-oss-20b-Q4_K_S.gguf
  • Kontextgröße: 26035
  • Leistungsmetriken: 34 Token/Sekunde nach der ersten Eingabeaufforderung, 0,7 Sekunden Zeit bis zum ersten Token
Ad

Modellkonfiguration

Der Nutzer gab diese Modelleinstellungen an (alle auf Standardwerten):

  • GPU-Auslagerung = 18
  • CPU-Thread-Pool-Größe = 7
  • Maximale gleichzeitige Vorgänge = 4
  • Anzahl der Experten = 4
  • Flash-Aufmerksamkeit = an

Die Q4_K_S-Quantisierung zeigt an, dass es sich um eine 4-Bit-quantisierte Version des 20-Milliarden-Parameter-Modells handelt, die den Speicherbedarf reduziert und gleichzeitig eine angemessene Leistung beibehält. Der 32-GB-RAM des Mac Mini ist für diese Modellgröße mit der angegebenen Kontextlänge ausreichend. Der Durchsatz von 34 Token/Sekunde ist ein praktischer Benchmark für Entwickler, die ähnliche lokale LLM-Setups auf Apple-Silicon-Hardware in Betracht ziehen.

📖 Read the full source: r/openclaw

Ad

👀 Siehe auch

Agent Forge: Open-Source-Tool erstellt Gerüste für Multi-Agent-Pipelines für Claude Code
Werkzeuge

Agent Forge: Open-Source-Tool erstellt Gerüste für Multi-Agent-Pipelines für Claude Code

Agent Forge ist eine Claude Code-Fähigkeit, die vollständige Multi-Agenten-Pipelines aus Anwendungsfallbeschreibungen generiert. Es erstellt Prompt-Dateien, Orchestrator-Skripte, Datenflussverzeichnisse und GitHub Actions-Konfigurationen basierend auf Mustern, die in bestehenden Multi-Agenten-Systemen beobachtet wurden.

OpenClawRadar
Pretticlaw: Eine leichtere Alternative zu OpenClaw mit schnellerer Einrichtung
Werkzeuge

Pretticlaw: Eine leichtere Alternative zu OpenClaw mit schnellerer Einrichtung

Pretticlaw ist eine leichte Alternative zu OpenClaw, die nur 2 Befehle für die Einrichtung benötigt, einen Speicherbedarf von 30 MB hat, in 2-3 Sekunden antwortet und ein integriertes Dashboard auf Port 6767 bietet.

OpenClawRadar
ClawsifyAI-Agent bearbeitet E-Mail-, Recherche- und Brainstorming-Aufgaben
Werkzeuge

ClawsifyAI-Agent bearbeitet E-Mail-, Recherche- und Brainstorming-Aufgaben

Ein Entwickler testete ClawsifyAI, einen KI-Agenten im Stil einer Greifarm-Maschine, eine Woche lang und stellte fest, dass es E-Mails, Recherche, repetitive Arbeiten und Brainstorming bewältigte. Der Agent liefert klare Rückmeldungen, praktische Lösungen und manchmal sogar bessere Ideen als ursprünglich geplant.

OpenClawRadar
yoyo: Lokaler MCP-Server für fundierte Codebase-Lektüre und geschützte Schreibvorgänge mit Claude Code
Werkzeuge

yoyo: Lokaler MCP-Server für fundierte Codebase-Lektüre und geschützte Schreibvorgänge mit Claude Code

yoyo ist ein Open-Source-Local-MCP-Server, der Coding-Agenten wie Claude Code mit fundierten Repository-Lesevorgängen und geschützten Schreibvorgängen in 16 Sprachen ermöglicht, darunter Rust, Go, Python und TypeScript. Er verhindert, dass fehlerhafte Änderungen unbemerkt übernommen werden, indem er maschinenlesbare guard_failure-Ausgaben zurückgibt und retry_plan für gezielte Reparaturen ermöglicht.

OpenClawRadar