Black LLAB: Arquitetura de Código Aberto para Roteamento Dinâmico de Modelos e Agentes de IA em Sandbox Docker

✍️ OpenClawRadar📅 Publicado: March 18, 2026🔗 Source
Black LLAB: Arquitetura de Código Aberto para Roteamento Dinâmico de Modelos e Agentes de IA em Sandbox Docker
Ad

Um desenvolvedor lançou o Black LLAB, um projeto de código aberto que tenta replicar sistemas de laboratórios de IA de ponta para execução autônoma de tarefas. O sistema aborda dois problemas principais: decidir manualmente qual modelo usar para diferentes prompts e executar com segurança o código de agentes de IA.

Componentes da Arquitetura

O sistema consiste em vários componentes-chave:

  • Roteamento Dinâmico de Complexidade: Usa o Mistral 3B Instruct para classificar prompts em uma escala de 1-100. Perguntas simples são direcionadas para modelos rápidos/baratos; tarefas complexas de programação são direcionadas para modelos pesados com modelagem de contexto XML "Lost in the Middle".
  • Agentes em Sandbox Docker: Integra o OpenClaw para implantar agentes em contêineres Docker dedicados e isolados. Os agentes podem escrever arquivos, fazer scraping da web e executar código sem tocar no sistema operacional do host.
  • RAG Híbrido Avançado: Constrói um Grafo de Conhecimento persistente usando NetworkX e usa um Cross-Encoder para recuperação de contexto precisa além da busca vetorial padrão.
  • Web e Visão ao Vivo: Integra-se com o SearxNG local para scraping da web e Pix2Text para visão/OCR local.
  • Limites de Orçamento: Inclui um controle deslizante de limite de gastos diário para evitar excedentes de API na nuvem.
Ad

Lista de Modelos

O sistema usa vários modelos para diferentes finalidades:

  • Roteamento/Lógica: Mistral 3B & Qwen 3.5 9B (Local)
  • Faixa Média/Velocidade: Xiaomi MiMo Flash
  • Tarefas Pesadas (Fallback): Claude Opus & Perplexity Sonar

Stack Tecnológica

O projeto é construído com FastAPI, Python, NetworkX, ChromaDB, Docker, Ollama, Playwright e uma interface de usuário inspirada em terminal HTML/JS vanilla.

O desenvolvedor se descreve como "mais um engenheiro mecânico do que de software" e está buscando feedback de desenvolvedores seniores sobre a arquitetura, particularmente a abordagem de sandboxing Docker. O projeto está disponível no GitHub para pesquisadores independentes que desejam executar tarefas autônomas sem ficar presos a um único provedor.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

Executando OpenClaw e Codex CLI Nativamente no Android via APK AnyClaw
Tools

Executando OpenClaw e Codex CLI Nativamente no Android via APK AnyClaw

Um desenvolvedor empacotou o OpenClaw e o Codex CLI em um APK Android chamado AnyClaw, permitindo que o gateway e a Interface de Controle sejam executados localmente em dispositivos Android ARM64 7.0+ sem necessidade de root. O projeto exigiu a construção de dependências a partir do código-fonte e a correção de múltiplos componentes para lidar com restrições específicas do Android.

OpenClawRadar
Título do artigo: Bot de Paper Trading Multi-LLM com Claude Opus como Engenheiro Líder e Gemini como Estrategista: Análise da Arquitetura
Tools

Título do artigo: Bot de Paper Trading Multi-LLM com Claude Opus como Engenheiro Líder e Gemini como Estrategista: Análise da Arquitetura

Um desenvolvedor solo compartilha um bot de paper-trading de 4.900 linhas de código na Alpaca, onde o Claude Opus 4 (Engenheiro) tem poder de veto sobre o Gemini Pro (Estrategista), com um registro de discordância com mais de 270 entradas chamado Strategist Codex.

OpenClawRadar
Avaliando localmente Qwen 3.6 27B como co-agente validador de Codex
Tools

Avaliando localmente Qwen 3.6 27B como co-agente validador de Codex

Um desenvolvedor criou um conjunto de avaliação reproduzível para testar perfis GGUF do Qwen 3.6 27B (llama.cpp) como um validador auxiliar para Codex, descobrindo que perfis de contexto 128k são necessários para tarefas de contexto longo e que há perda mínima de precisão com cache KV q8.

OpenClawRadar
A ferramenta Claude-context-lint audita a sobrecarga de tokens em projetos Claude Code.
Tools

A ferramenta Claude-context-lint audita a sobrecarga de tokens em projetos Claude Code.

Uma nova ferramenta chamada claude-context-lint analisa projetos do Claude Code para mostrar quanto da janela de contexto é consumida por arquivos CLAUDE.md, habilidades, servidores MCP e prompts do sistema antes da entrada do usuário. A ferramenta fornece recomendações específicas para reduzir o uso de tokens.

OpenClawRadar