Mac MiniでのローカルLLMパフォーマンスベンチマーク:OpenClawとLM Studioを使用

Redditユーザーが、32GB RAM搭載のMac Miniでローカル大規模言語モデルを実行した具体的なパフォーマンスベンチマークを共有しました。この投稿は、このハードウェア構成における具体的なパフォーマンスデータの不足に対応しています。
技術的セットアップ詳細
ユーザーは以下の構成と結果を報告しました:
- ソフトウェアバージョン: OpenClaw 2026.3.8、LM Studio 0.4.6+1
- モデル: Unsloth gpt-oss-20b-Q4_K_S.gguf
- コンテキストサイズ: 26035
- パフォーマンス指標: 初回プロンプト後34トークン/秒、初回トークン応答時間0.7秒
モデル構成
ユーザーは以下のモデル設定を指定しました(すべてデフォルト値):
- GPUオフロード = 18
- CPUスレッドプールサイズ = 7
- 最大同時実行数 = 4
- エキスパート数 = 4
- フラッシュアテンション = オン
Q4_K_S量子化は、これは200億パラメーターモデルの4ビット量子化バージョンであり、合理的なパフォーマンスを維持しながらメモリ要件を削減します。Mac Miniの32GB RAMは、指定されたコンテキスト長でこのモデルサイズに十分です。34トークン/秒のスループットは、Apple Siliconハードウェア上で同様のローカルLLMセットアップを検討している開発者にとって実用的なベンチマークです。
📖 Read the full source: r/openclaw
👀 See Also

Prime Agent:具有持久REPL和代理CRUD的自我改进RLM编码工具
Prime Agentは、永続的なIPythonカーネルと再帰言語モデルに基づくオープンソースのコーディングハーネスで、エージェントが自身のコンテキストとサブエージェントを管理できるようにします。

APEXテストベンチマーク結果:実践的コーディングタスクにおけるQwen 3.5の性能
APEXテストベンチマークの結果によると、Qwen 3.5モデルは70の実際のGitHubコーディングタスクで評価され、397Bバージョンはマスターレベルのタスクで1194 ELOまで低下しました。一方、GLM-4.7量子化モデルは1572 ELOでローカルモデルをリードしています。

個人用FastMCPサーバーのためのDrop-in OAuthプロバイダー、すべてのClaudeプラットフォーム対応
ある開発者が、Auth0やGoogleのような外部の認証サービスを必要とせずに、個人用のFastMCPサーバーをClaude.aiのWeb、モバイル、デスクトッププラットフォームで動作させるためのシングルファイルPython OAuthプロバイダーを作成しました。

SMELTコンパイラは、OpenClawワークスペースのトークン使用量を最大95%削減します。
SMELTは、OpenClawワークスペースのマークダウンファイルをより高密度なランタイム形式にコンパイルし、AIモデルに送信するコンテンツを関連するものだけに絞ります。ベンチマークでは、クエリごとのトークン数が76.1%から95.5%削減され、USER.mdやSOUR.mdなどの静的ファイルをメッセージごとに再処理する必要がなくなります。