Holaboss AI ランタイムが TypeScript に移行、永続的 MCP ポートを実装

RedditユーザーがHolaboss AIローカルエージェントランタイムのリポジトリを分析し、Ollama、llama.cpp、LM StudioなどのローカルLLMスタックとMCP(Model Context Protocol)を組み合わせて作業する開発者向けに、2つの重要なエンジニアリング改善点を指摘しました。
TypeScriptのみのパッケージング
ランタイムは完全にTypeScriptに移行されました。API層、ランナーのオーケストレーション、ワークスペースMCPホスティング、パッケージングのすべてがTypeScriptで実装されています。これにより、パッケージ化されたランタイムにはPythonのソースコードや依存関係が含まれなくなりました。ローカル/セルフホスト型スタックでは、バンドルサイズの縮小、構成要素の削減、言語間のずれの軽減が実現します。
永続的なMCPポート管理
ランタイムでは、ハードコーディングされたMCPポートの計算が廃止されました。代わりに、ポートはUNIQUE(port)制約と(workspace_id, app_id)をキーとしてSQLiteに永続化されます。ランナーは起動時に準備済みのMCPサーバーを統合します。このアプローチにより、ローカルサイドカーは再起動後も安定した衝突耐性のあるポートで復帰し、従来の「13100 + i推測」方式に取って代わります。
分析によれば、ローカルモデルが改善されるにつれ、焦点はモデルの品質からハーネスの品質へと移行しています。パッケージング、サイドカーのライフサイクル、ローカルサービスディスカバリー、ランタイム状態は、ローカルエージェントスタックが実際に堅牢に感じられるかどうかを決定する重要な要素となります。
リポジトリは以下で利用可能です: https://github.com/holaboss-ai/holaboss-ai
📖 Read the full source: r/LocalLLaMA
👀 See Also

Otterly: Claude Codeのサブスクリプションを通じてOpenClawをルーティングする
Otterlyは、ローカルのClaude CLIをOpenAI互換のHTTPサーバーとして公開する小さなnpmパッケージです。これにより、OpenClawのリクエストを従量課金のAPIレートではなく、Claude Codeサブスクリプションに課金できます。

A/Bテスト結果:oh-my-claudecodeフックはClaude Codeのパフォーマンスに最小限の影響しか示さず
ある開発者が、週間Max20トークンの7%をClaude Sonnet 4.6でoh-my-claudecodeフックのテストに費やし、単一セッションのコーディングタスクにおいてコード品質やコストに有意な改善が見られなかったことを発見しました。

LocalSynapse MCPサーバーがmacOSサポートと検索機能の改善を追加
ローカル文書を検索するオフラインMCPサーバー「LocalSynapse」がmacOSをサポートし、複数単語の検索クエリに関する修正を含むアップデートを実施。開発者はフィードバックに基づく改善として、位置調整クリックブーストや時間減衰によるプロモーションなどを実装。

LLMSpend: AnthropicおよびOpenAI SDK向けのオープンソースコストトラッカー
LLMSpendは、AnthropicとOpenAIのSDK呼び出しに2行のコードでコスト追跡機能を追加するPythonライブラリです。外部にデータを送信することなく、ローカルのSQLiteストレージ、CLIレポート、ウェブダッシュボードを提供します。