Exécuter NemoClaw avec vLLM Local : Notes de Configuration et Observations sur l'Ingénierie d'Agents

Configuration locale de NemoClaw avec vLLM
Un développeur a partagé son expérience d'exécution de NemoClaw, une plateforme d'agents IA sandbox de NVIDIA, avec un modèle local Nemotron 9B v2 en utilisant vLLM sur WSL2. La configuration est basée sur le fork de NemoClaw de jieunl24.
Détails techniques clés
Routage de l'inférence : Le routage de l'inférence de NemoClaw suit un chemin propre : inference.local → passerelle → vLLM. Cependant, des bogues initiaux d'intégration ont nécessité un contournement réseau à 3 couches qui a depuis été corrigé via la PR #412.
Compatibilité des analyseurs : Les analyseurs vLLM intégrés (qwen3_coder, nemotron_v3) sont incompatibles avec les modèles Nemotron v2. Vous avez besoin des analyseurs officiels de NVIDIA provenant du dépôt NeMo à la place.
Écart en ingénierie des agents : OpenClaw en tant que plateforme d'agents fournit une infrastructure solide mais est livré avec un minimum d'ingénierie de prompts. L'écart entre "le modèle sert du texte" et "l'agent effectue un travail utile" concerne principalement l'échafaudage plutôt que les limitations de capacité du modèle.
Ressources
- Article de blog couvrant l'architecture, la configuration des analyseurs vLLM et les observations sur l'ingénierie des agents : https://github.com/soy-tuber/nemoclaw-local-inference-guide/blob/master/BLOG-openclaw-agent-engineering.md
- Guide de configuration (V2) avec routage inference.local et sans contournements réseau : https://github.com/soy-tuber/nemoclaw-local-inference-guide
- Problème original NemoClaw #315 : https://github.com/NVIDIA/NemoClaw/issues/315
Cette configuration démontre le déploiement local pratique des plateformes d'agents IA, mettant en lumière à la fois les détails de mise en œuvre technique et les défis persistants en ingénierie des agents.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

IUM : L'Indexeur de Symboles MCP Réduit l'Utilisation de Jetons des Agents IA de 15,9x par rapport à grep
IUM indexe les bases de code dans une matrice SQLite d'événements de symboles, exposant les coordonnées exactes fichier:ligne, le traçage de graphe d'appels et la recherche sémantique via MCP. Testé avec DataFusion (1 538 fichiers), montrant 15,9 fois moins de tokens que grep pour des requêtes équivalentes.

Antigravité 2.0 domine le benchmark architectural 3D OpenSCAD – ModelRift teste 6 LLM sur le Panthéon
ModelRift a testé 6 LLM pour construire le Panthéon en OpenSCAD. Antigravity a obtenu 4,5/5 en qualité architecturale, battant le baseline Codex 5.5. Cursor 3.5 était le plus rapide mais le plus faible.

Parlez avec Claw : Interface Vocale iOS Open Source pour les Bots OpenClaw Telegram
Une application iOS open source qui permet une interaction vocale avec les bots Telegram alimentés par OpenClaw. L'application envoie l'audio à un serveur Mac local pour traitement, avec des réponses retournées sous forme de texte et d'audio.

Le plugin HomeClaw connecte Apple HomeKit à OpenClaw
HomeClaw est un plugin OpenClaw qui connecte les appareils Apple Home/HomeKit à OpenClaw. Il nécessite un compte développeur Apple pour être construit et exécuté en raison des restrictions d'Apple HomeKit pour les distributions notariées.