VoidLLM : Proxy à connaissance zéro pour Ollama et vLLM avec contrôle d'accès par équipe

VoidLLM est un serveur proxy qui s'intercale entre vos applications et les serveurs LLM locaux comme Ollama et vLLM. Il ajoute un contrôle d'accès par organisation et équipe, une gestion de clés API, un suivi d'utilisation et une limitation de débit sans jamais voir vos prompts ou votre contenu.
Fonctionnalités clés
- Compatible OpenAI — fonctionne avec tout SDK qui prend en charge le format d'API OpenAI
- Adaptateurs pour fournisseurs : Ollama, vLLM, Anthropic, Azure et OpenAI
- Surcharge proxy <2ms
- Limitation de débit par organisation, équipe ou clé API (distribuée via Redis)
- Suivi des coûts et tableau de bord analytique
- Aucune journalisation de contenu — uniquement des métadonnées (qui a accédé à quel modèle et combien de jetons ont été utilisés)
Cas d'utilisation
Si vous exécutez Ollama ou vLLM localement et souhaitez le partager au sein d'une équipe avec un contrôle d'accès approprié et une visibilité sur l'utilisation, ce proxy offre ces capacités tout en préservant la confidentialité grâce à son architecture à connaissance nulle.
L'outil est disponible sur GitHub à github.com/voidmind-io/voidllm.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Spec27 : Validation pilotée par spécifications pour les agents d’IA – Tests au niveau de l’API sans accès interne
Spec27 est un nouvel outil de Safe Intelligence pour la validation pilotée par spécifications des agents IA. Il teste le comportement des agents de l'extérieur, en exécutant des vérifications adverses et de robustesse sur les interfaces principales, sans nécessiter de SDK, de passerelles ou de traces internes.

Création d'un RAG agentic pour Obsidian avec Claude et d'un harnais d'évaluation pour détecter les hallucinations
Un développeur a construit un système RAG agentique sur un coffre Obsidian pour permettre à Claude de répondre à des questions issues de livres d'ingénierie, puis a créé un harnais d'évaluation utilisant Claude Sonnet comme juge pour détecter quand l'agent avait tort avec assurance. Des itérations de la grille d'évaluation ont amélioré l'accord juge-humain de 39 % à 94 %.

Protocole Mind : Un système open-source offre à Claude une mémoire persistante et une intégration biométrique en temps réel.
Mind Protocol est un système open-source où Claude fonctionne en continu en tant que compagnon autonome avec une mémoire persistante à travers toutes les sessions et des données en temps réel de montre Garmin injectées dans chaque conversation. L'architecture utilise Claude Code comme moteur central avec un orchestrateur qui génère des sessions parallèles et gère le cycle de vie.

Automatiser la revue des PR GitHub avec les agents Claude Code
Un développeur a créé un agent qui traite les mentions GitHub, lance des travailleurs Claude Code pour examiner ou corriger les PR, et ne remonte aux humains que les cas ambigus.