Gemma4 26B-A4Bは、Web検索と画像サポートを備え、高速なローカルパフォーマンスを実現します

Gemma4 26B-A4Bの性能と機能
gemma-4-26B-A4Bモデルは、ローカル利用において強力な性能を示しており、ソースによるとRTX 4090 GPUで実行時に約145トークン/秒の速度を報告しています。この能力と速度の組み合わせにより、応答性の高いローカルアプリケーションに適しています。
ソースからの主な機能
- モデル: gemma-4-26B-A4B
- 性能: RTX 4090上で~145 t/s(トークン/秒)
- 統合: Web検索MCP(Model Context Protocol)サポート
- マルチモーダル: 画像サポートを含む
- プラットフォーム: MacとiPhone利用向けにセットアップが文書化
ソースでは、シンプルな工夫と短いシステムプロンプトで体験を改善できると述べていますが、これらの最適化に関する具体的な詳細は抜粋では提供されていません。著者は、複数のデバイスでの設定と使用法をカバーするブログ記事で完全なセットアッププロセスを文書化しています。
このセットアップを実装することに関心のある開発者向けに、完全な設定詳細、システムプロンプト、および最適化技術は、提供されたURLの参照ブログ記事で利用可能です。
📖 Read the full source: r/LocalLLaMA
👀 See Also

ホークアイアップデートで、スウォーム・オーケストレーション、リモートタスク、ローカルモデルサポートが追加されました。
Hawkeye v1.0+ は、マルチエージェント・スウォーム・オーケストレーション、リモートタスクキューイング、および改善された Ollama/LM Studio 統合をサポートするようになりました。ローカルファーストの AI エージェント・フライトレコーダーは、開発者がエージェントがリポジトリ内で作業する際に何が起こるかを追跡するのに役立ちます。

Mike: セルフホスティングとマルチモデルに対応したオープンソース法律AI
Mikeは、HarveyやLegoraに代わるオープンソースの代替品であり、ドキュメントチャット、表形式抽出、ワークフローテンプレートを提供します。すべて自己ホスティング可能で、ClaudeやGeminiのAPIキーを使用できます。

フェムトボット:低リソース環境向けの効率的なRustエージェント
Femtobotは、低リソースマシン上で効率的に動作するように設計された軽量なRustベースのAIエージェントです。約10MBのバイナリで大規模なランタイム依存関係なしに、古いRaspberry Piなどの低リソースマシンで動作します。

Attesor: Linux VM向けRosetta 2のAI駆動リバースエンジニアリング
Attesorは、AppleのRosetta 2バイナリ翻訳技術をリバースエンジニアリングするGitHubプロジェクトで、そのアーキテクチャを文書化し、Linux仮想マシン上でのx86_64からARM64への翻訳を可能にすることを目指しています。