Mac MiniでのローカルLLMパフォーマンスベンチマーク:OpenClawとLM Studioを使用

✍️ OpenClawRadar📅 公開日: April 18, 2026🔗 Source
Mac MiniでのローカルLLMパフォーマンスベンチマーク:OpenClawとLM Studioを使用
Ad

Redditユーザーが、32GB RAM搭載のMac Miniでローカル大規模言語モデルを実行した具体的なパフォーマンスベンチマークを共有しました。この投稿は、このハードウェア構成における具体的なパフォーマンスデータの不足に対応しています。

技術的セットアップ詳細

ユーザーは以下の構成と結果を報告しました:

  • ソフトウェアバージョン: OpenClaw 2026.3.8、LM Studio 0.4.6+1
  • モデル: Unsloth gpt-oss-20b-Q4_K_S.gguf
  • コンテキストサイズ: 26035
  • パフォーマンス指標: 初回プロンプト後34トークン/秒、初回トークン応答時間0.7秒

モデル構成

ユーザーは以下のモデル設定を指定しました(すべてデフォルト値):

  • GPUオフロード = 18
  • CPUスレッドプールサイズ = 7
  • 最大同時実行数 = 4
  • エキスパート数 = 4
  • フラッシュアテンション = オン

Q4_K_S量子化は、これは200億パラメーターモデルの4ビット量子化バージョンであり、合理的なパフォーマンスを維持しながらメモリ要件を削減します。Mac Miniの32GB RAMは、指定されたコンテキスト長でこのモデルサイズに十分です。34トークン/秒のスループットは、Apple Siliconハードウェア上で同様のローカルLLMセットアップを検討している開発者にとって実用的なベンチマークです。

📖 Read the full source: r/openclaw

Ad

👀 See Also

Prime Agent:具有持久REPL和代理CRUD的自我改进RLM编码工具
Tools

Prime Agent:具有持久REPL和代理CRUD的自我改进RLM编码工具

Prime Agentは、永続的なIPythonカーネルと再帰言語モデルに基づくオープンソースのコーディングハーネスで、エージェントが自身のコンテキストとサブエージェントを管理できるようにします。

OpenClawRadar
APEXテストベンチマーク結果:実践的コーディングタスクにおけるQwen 3.5の性能
Tools

APEXテストベンチマーク結果:実践的コーディングタスクにおけるQwen 3.5の性能

APEXテストベンチマークの結果によると、Qwen 3.5モデルは70の実際のGitHubコーディングタスクで評価され、397Bバージョンはマスターレベルのタスクで1194 ELOまで低下しました。一方、GLM-4.7量子化モデルは1572 ELOでローカルモデルをリードしています。

OpenClawRadar
個人用FastMCPサーバーのためのDrop-in OAuthプロバイダー、すべてのClaudeプラットフォーム対応
Tools

個人用FastMCPサーバーのためのDrop-in OAuthプロバイダー、すべてのClaudeプラットフォーム対応

ある開発者が、Auth0やGoogleのような外部の認証サービスを必要とせずに、個人用のFastMCPサーバーをClaude.aiのWeb、モバイル、デスクトッププラットフォームで動作させるためのシングルファイルPython OAuthプロバイダーを作成しました。

OpenClawRadar
SMELTコンパイラは、OpenClawワークスペースのトークン使用量を最大95%削減します。
Tools

SMELTコンパイラは、OpenClawワークスペースのトークン使用量を最大95%削減します。

SMELTは、OpenClawワークスペースのマークダウンファイルをより高密度なランタイム形式にコンパイルし、AIモデルに送信するコンテンツを関連するものだけに絞ります。ベンチマークでは、クエリごとのトークン数が76.1%から95.5%削減され、USER.mdやSOUR.mdなどの静的ファイルをメッセージごとに再処理する必要がなくなります。

OpenClawRadar