オフグリッドモバイルアプリ、オンデバイスAIツールを追加し3倍の速度向上を実現

オンデバイスAIモバイルアプリ「Off Grid」がアップデートされ、ツール使用機能と大幅なパフォーマンス向上が追加されました。このアプリは現在、APIキー、サーバー、またはクラウド機能を必要とせずに、AIモデルがオフラインでツールを呼び出せるようになりました。
主な機能とパフォーマンス
このアップデートでは、ウェブ検索、電卓、日付/時刻機能、デバイス情報アクセスのための自動ツールループが導入されています。開発者によると、これにより30億パラメータのモデルがスマートフォン上で直接推論、ツール呼び出し、結果の統合を行えるようになり、「ローカル玩具」と「有用なアシスタント」のギャップが埋められるとのことです。
パフォーマンス向上は設定可能なKVキャッシュオプションによるものです。ユーザーは現在、3つのKVキャッシュタイプから選択できます:
f16q8_0q4_0
q4_0キャッシュを使用すると、以前は10トークン/秒を生成していたモデルが、現在は30トークン/秒に達します。このアプリには、最初の生成後に高速な設定を提案するパフォーマンスナッジ機能が含まれています。
モデルサポートとプラットフォーム対応状況
Off GridはGGUF形式のモデルをサポートしており、以下を含みます:
- Qwen 3
- Llama 3.2
- Gemma 3
- Phi-4
- その他のGGUF互換モデル
このアプリは現在、サイドロード要件なしで両方の主要アプリストアで利用可能です。App StoreとGoogle Playから直接インストールできます。
コア機能と哲学
このアップデートで変わらなかった点:
- MITライセンスで完全オープンソース
- デバイスからデータが一切流出しない(分析、テレメトリ、匿名使用データなし)
- テキスト生成(15-30トークン/秒)、画像生成(NPUで5-10秒)、視覚AI、音声文字起こし、文書分析を含むオフライン機能
開発者は、このプロジェクトは「あなたのポケットにあるスマートフォンは、最も監視されるコンピューターではなく、最もプライベートなコンピューターであるべきだ」という信念に動機づけられていると述べています。
📖 完全なソースを読む: HN AI Agents
👀 See Also

Apideck CLI:AIエージェント向けMCPの低コンテクスト代替手段
Apideck CLIは、ツールスキーマに数万トークンを使用する代わりに、約80トークンのエージェントプロンプトを使用するAIエージェントインターフェースであり、MCPのコンテキストウィンドウ消費問題に対処しています。ベンチマークによると、同一の操作に対してMCPはCLIよりも4倍から32倍多くのトークンを消費する可能性があります。

ローカル35B MoEモデル、Agent OSコード障害率を0%に低減
ある開発者の報告によると、マルチエージェントシステムのランタイムをQwen 3.6 35B A3B(MoE、アクティブパラメータ3B)に切り替えたところ、コードの不具合が解消され、5層の検証ゲートを通じて100%の成功率を達成したとのことです。

Claude CodeがNVIDIA NIMゲートウェイ経由で240以上のモデルをサポート — エージェンティックコーディング向けNemotron-3 120Bを含む
Claude Code は、/model コマンドでセッション中に 240 以上の NVIDIA NIM モデルに切り替え可能。Nemotron-3 Super 120B 思考型バリアントは、複数ファイルのリファクタリングやエージェントタスクで強力な結果を示している。

SigMap v8.9:決定論的コンテキストレイヤーがAIコーディングエージェントのトークン使用量を97%削減
SigMap v8.9はトークン削減97%、ヒット率88%の検索、タスクあたりのプロンプト数を49%削減。Copilot、Claude Code、Cursor、Windsurf、Codex、OpenCode、Gemini CLIに対応。ゼロ依存、完全オフライン。