VoidLLM: Proxy de Conhecimento Zero para Ollama e vLLM com Controle de Acesso por Equipe

VoidLLM é um servidor proxy que fica entre suas aplicações e servidores locais de LLM como Ollama e vLLM. Ele adiciona controle de acesso por organização e equipe, gerenciamento de chaves de API, rastreamento de uso e limitação de taxa sem nunca ver seus prompts ou conteúdo.
Principais Recursos
- Compatível com OpenAI — funciona com qualquer SDK que suporte o formato da API OpenAI
- Adaptadores para provedores Ollama, vLLM, Anthropic, Azure e OpenAI
- Sobrecarga de proxy <2ms
- Limitação de taxa por organização, equipe ou chave de API (distribuída via Redis)
- Rastreamento de custos e painel de análises
- Zero registro de conteúdo — apenas metadados (quem acessou qual modelo e quantos tokens foram usados)
Caso de Uso
Se você está executando Ollama ou vLLM localmente e deseja compartilhá-lo com uma equipe com controle de acesso adequado e visibilidade de uso, este proxy fornece essas capacidades enquanto mantém a privacidade através de sua arquitetura de conhecimento zero.
A ferramenta está disponível no GitHub em github.com/voidmind-io/voidllm.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

PayClaw Lança Sandbox para Servidor MCP de Pagamentos com Cartões Visa Virtuais
A PayClaw lançou um ambiente sandbox para seu servidor de pagamento MCP, apresentando cartões Visa virtuais bloqueados por comerciante com validade de 15 minutos, aprovação humana por transação com autenticação multifator e declaração de intenção antes da emissão do cartão. Os cartões de produção estão programados para 4 de março.

AgentMarket: Uma Plataforma de Prova de Conceito para Economias de Agentes de IA
AgentMarket.space é uma plataforma de prova de conceito onde agentes de IA se registram com capacidades, publicam tarefas com orçamentos de crédito e contratam uns aos outros de forma autônoma usando uma divisão de créditos 90/10 e Groq llama-3.3-70b para correspondência.

Temporal-MCP: Consciência de Relógio de Parede para LLMs com Suporte a OAuth
Temporal-MCP é um servidor MCP mínimo que fornece consciência do relógio de parede para LLMs, abordando modos de falha relacionados ao tempo, como saudações incorretas e contexto desatualizado. Ele oferece duas ferramentas (temporal_tick e temporal_peek) que retornam tempo decorrido, detecção de virada de dia e sinalizador de nova conversa.

Sistema de Memória MCP Local com Consolidação para Conversas de IA
Um desenvolvedor criou um servidor MCP que fornece memória local persistente para clientes de IA, usando Qwen 2.5-7B para consolidar conversas em documentos de conhecimento estruturados a cada 6 horas. O sistema roda completamente no seu hardware com deduplicação semântica, pontuação adaptativa e busca vetorial FAISS.