Bernstein: Um orquestrador semelhante ao Kubernetes para agentes de codificação de IA com verificação e políticas de modelo

✍️ OpenClawRadar📅 Publicado: April 13, 2026🔗 Source
Bernstein: Um orquestrador semelhante ao Kubernetes para agentes de codificação de IA com verificação e políticas de modelo
Ad

Bernstein é um orquestrador para agentes de codificação de IA que o criador descreve como "Kubernetes para agentes de codificação". Diferente de ferramentas mais simples que geram agentes em worktrees paralelas, Bernstein aborda o que o desenvolvedor chama de "os outros 95%" do problema.

Principais Recursos

O sistema inclui vários componentes críticos:

  • Verificação: Um componente "zelador" verifica independentemente as saídas dos agentes após cada tarefa. Ele executa testes, verifica diferenças e analisa a saída porque "os agentes mentem" - eles podem afirmar que os testes passam quando não passam ou dizer que cometeram arquivos quando não o fizeram.
  • Motor de Política de Modelo: Fornece listas de permissão/negação por provedor, restrições de residência de dados, roteamento preferencial e tetos de custo. O criador compara isso a "políticas de rede do K8s, mas para provedores de LLM".
  • Agendamento Determinístico: Usa Python puro para agendamento em vez de LLMs, criando fluxo de controle determinístico com zero tokens de LLM gastos em coordenação. Um bandit epsilon-greedy aprende o roteamento ao longo do tempo.
  • Design Agnostico de Agentes: Inclui 13 adaptadores para Claude Code, Codex, Gemini CLI, Cursor, Qwen, Aider, Amp, Roo Code, Goose, Kilo, Kiro, OpenCode e agentes genéricos. Claude Code tem a integração mais profunda.
  • Recursos de Escala: Com mais de 500K linhas e ~5000 testes, Bernstein inclui disjuntores, detecção de anomalias de custo, detecção de loops, detecção de deadlocks, varredura de PII, logs de auditoria encadeados por HMAC, permissões progressivas e quarentena para saídas suspeitas.
  • Auto-Desenvolvimento: Pode se desenvolver usando bernstein --evolve.
Ad

Detalhes Técnicos

O criador observa que gerar agentes em worktrees é "o hello world deste espaço" e que a maioria dos frameworks multiagente usa um LLM para agendar outros LLMs, o que é "lento, caro e não determinístico". A abordagem do Bernstein usa Python puro para fluxo de controle determinístico.

O projeto foi testado em escala com mais de 500K linhas de código e aproximadamente 5000 testes. O desenvolvedor construiu recursos como disjuntores e detecção de anomalias porque "as coisas quebraram e essas foram as correções".

O criador é um desenvolvedor solo de Israel que menciona "construindo sob foguetes (literalmente)" e que o projeto superou suas capacidades, buscando contribuidores.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Corvo do Conhecimento: Um Plugin de Base de Conhecimento Pesquisável para Claude
Tools

Corvo do Conhecimento: Um Plugin de Base de Conhecimento Pesquisável para Claude

Knowledge Raven é uma ferramenta que permite ao Claude pesquisar seus documentos de fontes como Confluence, Notion, Google Drive, Dropbox e GitHub por meio de um plugin do Claude Desktop ou servidor MCP, oferecendo pesquisa semântica, pesquisa por palavras-chave e recuperação completa de documentos.

OpenClawRadar
Integração do WordPress.com MCP Adiciona Capacidades de Escrita para Claude
Tools

Integração do WordPress.com MCP Adiciona Capacidades de Escrita para Claude

A integração do MCP do WordPress.com agora suporta operações de escrita, permitindo que o Claude crie rascunhos de posts, construa páginas, gerencie comentários, corrija textos alternativos de imagens e reorganize categorias de conteúdo diretamente em sites do WordPress.com. Antes de gerar conteúdo, o Claude lê o tema do site para entender elementos de design como cores, fontes e padrões de blocos.

OpenClawRadar
Agente de IA Local Alcança Latência de STT e TTS em Sub-Segundos com Servidores de Código Aberto
Tools

Agente de IA Local Alcança Latência de STT e TTS em Sub-Segundos com Servidores de Código Aberto

Um desenvolvedor alcançou ~0,2s de latência STT usando Whisper large-v3-turbo com arquitetura híbrida de GPU gerenciada por threads e ~250ms de latência TTS com Coqui-TTS otimizado para síntese de baixa latência. Ambas as implementações são totalmente auto-hospedadas e de código aberto.

OpenClawRadar
🦀
Tools

VMs macOS com Apple Silicon: Inferência de LLM 11–16× mais rápida com Shim de Capacidade Metal

O shim de capacidade Metal com escopo de processo da Cua desbloqueia kernels mais novos em VMs macOS, acelerando a inferência do llama.cpp em até 16× no Apple Silicon. Lançamento de pesquisa em código aberto.

OpenClawRadar