SpruceChatは、llama.cppを介してMiyooハンドヘルド端末上で0.5B LLMをオンデバイスで動作させます。

概要
SpruceChatは、llama.cppを使用してQwen2.5-0.5B言語モデルを完全にオンデバイスで複数の携帯型ゲーム機上で動作させるプロジェクトです。初期設定後はクラウド接続やWiFiを必要としません。
主な詳細
モデルは初回起動後にRAMに常駐し、生成時にはトークンが一つずつストリーミングされます。Miyoo A30、Miyoo Flip、Trimui Brick、Trimui Smart Proで動作します。
Miyoo A30(Cortex-A7クアッドコアプロセッサ搭載)でのパフォーマンス:
- モデルロード:初回起動時約60秒
- 生成速度:約1-2トークン/秒
- プロンプト評価:約3トークン/秒
開発者は「高速ではないが、ストリーミングされるため思考過程を観察できる」と述べており、64ビットデバイスの方が速いと指摘しています。
このAIは「トウヒの木のような性格:忍耐強く、急がず、全てのものに静かに驚嘆する」と表現されています。
デバイスがWiFiに接続されている場合、ブラウザからllama-serverにアクセスして、スマートフォンやノートパソコンの実キーボードでチャットすることも可能です。
リポジトリはhttps://github.com/RED-BASE/SpruceChatにあります。このプロジェクトはClaudeの助けを借りて構築され、デバイスサポート拡大に取り組む共同作業者も既に参加しています。初回リリースではarmhfとaarch64バイナリの両方が提供され、モデルも同梱されています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

ヘッドツーヘッドのコードレビュー実験では、同じコードベースで3つのAIツールを比較します。
動画実験では、Codex、Claude Code、およびSextantを組み合わせたClaude Codeが、同一のコードレビュー課題で比較されます。Codexは結果を検証し、どのレポートがより価値があるかを判断します。焦点は、ワークフローと構造がAIの気づきや優先順位付けにどのように影響するかです。

マルチエージェントAIシステムの比較:AnthropicのHarness対AgynのEngineering Orgモデル
Anthropicは長期間実行されるアプリケーション開発のためのハーネス設計を公開し、Agynのチームベース自律型ソフトウェア工学のためのマルチエージェントシステムは先月オープンソース化されました。両システムともモノリシックなエージェントを採用せず、役割分離、構造化された引き継ぎ、レビューループを重視しています。

Atoo Studio:マルチプロジェクトのClaudeコードワークフローを管理するためのオープンソースワークスペース
Atoo Studioは、複数のプロジェクトでClaude Codeを使用する際のターミナルやタブの混乱に対処するために構築されたオープンソースワークスペースです。Gitブランチのようなセッションフォークを導入し、Claude Code、Codex CLI、Gemini CLI間での継続を可能にします。

idea-reality-mcp: MCPサーバーは、Claudeがコードを書く前に既存のツールをチェックします
開発者がidea-reality-mcpというMCPサーバーを構築し、Claudeがコードを書く前にGitHubリポジトリ、Hacker Newsの議論、npmパッケージ、PyPIをスキャンし、市場競争の度合いを示す0〜100の「現実シグナル」スコアを返します。