Caliby: Banco de Dados Vetorial Embarcado de Código Aberto para Agentes de IA com Armazenamento Híbrido de Texto + Vetor

✍️ OpenClawRadar📅 Publicado: May 9, 2026🔗 Source
Caliby: Banco de Dados Vetorial Embarcado de Código Aberto para Agentes de IA com Armazenamento Híbrido de Texto + Vetor
Ad

Caliby agora é open-source: um banco de dados vetorial embutido e em processo projetado para cargas de trabalho de Agentes de IA e RAG. Desenvolvido por uma equipe que inclui um PhD do Grupo de Banco de Dados do MIT (equipe de Michael Stonebraker) e a Sea-Land AI, é uma única biblioteca C++ com bindings para Python.

Por que outro banco vetorial?

A equipe considerou as soluções existentes insuficientes para casos de uso com agentes/LLM:

  • FAISS: Puramente em memória, sem persistência — reiniciar limpa o índice.
  • pgvector: Teto de desempenho devido à dependência do PostgreSQL.
  • Chroma / Qdrant / Milvus: Exigem serviços separados, muito pesados para cenários embutidos.
  • LanceDB: Embutido, mas carece de índices avançados como DiskANN, gargalos de desempenho.

Caliby visa ser um mecanismo de dados leve e incorporável como o DuckDB, mas para armazenamento de vetores + texto.

Arquitetura: Armazenamento Híbrido de Texto + Vetores

Caliby unifica dados de texto e vetores em um único sistema. Em vez de gerenciar um banco vetorial e um banco relacional separadamente, você armazena embeddings, texto bruto e metadados em uma única biblioteca. A arquitetura usa um pool de buffers organizado por páginas para persistência.

Ad

Índices Suportados

  • HNSW: Recuperação geral de alto desempenho, otimizado para CPU.
  • DiskANN (Grafo Vamana): Projetado para cenários baseados em disco, supera FAISS em disco.
  • IVF+PQ: Arquivo invertido com quantização de produto para índices compactos.

Caliby também suporta busca por força bruta com funções de distância SIMD (AVX-512, AVX2, SSE) (L2, Produto Interno, Cosseno).

Alegações de Desempenho

Caliby supera o pgvector em 4x e ultrapassa significativamente o FAISS em cenários de armazenamento em disco. Ele lida com milhões a dezenas de milhões de vetores em disco sem exigir um serviço separado.

Primeiros Passos

Simplesmente instale o pacote:

pip install caliby

A API Python expõe as classes HnswIndex, DiskANN e IVFPQIndex via pybind11. Sem dependências, sem configuração de servidor, sem DevOps.

Para Quem É

Desenvolvedores de Agentes de IA e construtores de pipelines RAG que desejam um banco de dados vetorial embutido, com zero infraestrutura e capacidades híbridas de texto+vetores com desempenho de nível de produção.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Agente OpenClaw Adquire Capacidade de Chamadas Telefônicas por Meio de Habilidade Personalizada
Tools

Agente OpenClaw Adquire Capacidade de Chamadas Telefônicas por Meio de Habilidade Personalizada

Um desenvolvedor criou uma habilidade personalizada para agentes OpenClaw auto-hospedados que permite funcionalidade de chamadas telefônicas, permitindo que o agente inicie chamadas com base em gatilhos como conclusões de builds ou falhas de servidor. A implementação fornece interação por voz com todas as capacidades de chat, incluindo pesquisas na web e configuração de alertas.

OpenClawRadar
Scrapling integrado como a espinha dorsal de raspagem do OpenClaw
Tools

Scrapling integrado como a espinha dorsal de raspagem do OpenClaw

Scrapling, uma biblioteca de código aberto que aprende a estrutura da página e se adapta a mudanças, foi integrada ao OpenClaw como seu mecanismo de scraping central. É 774x mais rápido que BeautifulSoup com Lxml e suporta múltiplos tipos de seletores com sessões assíncronas.

OpenClawRadar
Duas Habilidades de Código do Claude para Gerenciar a Configuração CLAUDE.md
Tools

Duas Habilidades de Código do Claude para Gerenciar a Configuração CLAUDE.md

Um desenvolvedor criou duas habilidades Claude Code para lidar com a configuração do CLAUDE.md: /cc-init cria configurações enxutas para novos projetos, e /cc-optimize analisa projetos existentes em busca de bloat e problemas. Ambas visam reduzir a sobrecarga de contexto e melhorar o seguimento de instruções.

OpenClawRadar
monge: Uma habilidade que silencia a narração do agente para economizar contexto e tokens
Tools

monge: Uma habilidade que silencia a narração do agente para economizar contexto e tokens

Um usuário do Reddit publicou 'monk', uma habilidade que remove narração, preâmbulos e posâmbulos das respostas do agente Claude, alegando ~54% de redução de tokens de saída por turno e 29-39% de ganho de capacidade de contexto em 100 rodadas.

OpenClawRadar