Holaboss AI Runtime Migre vers TypeScript, Implémente des Ports MCP Persistants

✍️ OpenClawRadar📅 Publié: April 15, 2026🔗 Source
Holaboss AI Runtime Migre vers TypeScript, Implémente des Ports MCP Persistants
Ad

Un utilisateur de Reddit a analysé le dépôt du runtime d'agent local Holaboss AI, mettant en lumière deux améliorations techniques significatives pour les développeurs travaillant avec des piles LLM locales comme Ollama, llama.cpp et LM Studio combinées au MCP (Model Context Protocol).

Packaging exclusif en TypeScript

Le runtime a été entièrement migré vers TypeScript. La couche API, l'orchestration des runners, l'hébergement MCP des espaces de travail et le packaging résident désormais tous en TypeScript. Cela signifie que le runtime emballé ne contient plus de code source Python ni de dépendances Python. Pour les piles locales/auto-hébergées, cela se traduit par un bundle plus petit, moins de pièces mobiles et moins de dérive inter-langages.

Ad

Gestion persistante des ports MCP

Le runtime a éliminé le calcul manuel des ports MCP. Désormais, les ports sont persistés dans SQLite avec une contrainte UNIQUE(port) et (workspace_id, app_id) comme clé. Le runner fusionne les serveurs MCP préparés lors du démarrage. Cette approche garantit que les sidecars locaux redémarrent sur des ports stables et résistants aux collisions, remplaçant la méthode typique du "13100 + estimation".

L'analyse suggère qu'à mesure que les modèles locaux s'améliorent, l'accent se déplace de la qualité des modèles vers la qualité de l'infrastructure. Le packaging, le cycle de vie des sidecars, la découverte des services locaux et l'état du runtime deviennent des facteurs critiques pour déterminer si une pile d'agents locaux semble solide en pratique.

Le dépôt est disponible à l'adresse : https://github.com/holaboss-ai/holaboss-ai

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Le moteur d'inférence Atlas devient open source : Rust pur + CUDA, plus de 100 tok/s sur DGX Spark
Tools

Le moteur d'inférence Atlas devient open source : Rust pur + CUDA, plus de 100 tok/s sur DGX Spark

Atlas est maintenant open source — un moteur d'inférence Rust + CUDA qui atteint un pic de 130 tok/s sur Qwen3.5-35B (NVFP4) sur un seul DGX Spark, sans runtime Python et avec un démarrage à froid inférieur à 2 minutes.

OpenClawRadar
Le plugin SLOP ajoute une conscience en temps réel de l'état des applications aux agents OpenClaw.
Tools

Le plugin SLOP ajoute une conscience en temps réel de l'état des applications aux agents OpenClaw.

Un nouveau plugin OpenClaw s'intègre à SLOP (State Layer for Observable Programs), offrant aux agents IA un accès structuré à l'état des applications et à des actions contextuelles. Le plugin découvre automatiquement les applications compatibles SLOP via ~/.slop/providers/ et un pont d'extension Chrome.

OpenClawRadar
Scrapling intégré comme colonne vertébrale de scraping d'OpenClaw
Tools

Scrapling intégré comme colonne vertébrale de scraping d'OpenClaw

Scrapling, une bibliothèque open-source qui apprend la structure des pages et s'adapte aux changements, a été intégrée à OpenClaw en tant que moteur de scraping principal. Elle est 774 fois plus rapide que BeautifulSoup avec Lxml et prend en charge plusieurs types de sélecteurs avec des sessions asynchrones.

OpenClawRadar
Red Queen : Un orchestrateur déterministe qui utilise Claude Code comme pool de travailleurs
Tools

Red Queen : Un orchestrateur déterministe qui utilise Claude Code comme pool de travailleurs

Red Queen utilise une machine d'états pour orchestrer les sous-processus Claude Code, éliminant les erreurs de routage LLM et le gaspillage de tokens liés aux méga-prompts.

OpenClawRadar