Kelet: Análise Automatizada de Causa Raiz para Agentes de IA

O que o Kelet faz
Kelet é um serviço que monitora continuamente agentes de IA e aplicações de LLM em produção para identificar automaticamente por que eles falham. Em vez de agentes travarem com erros claros, eles frequentemente dão respostas erradas silenciosamente, exigindo análise manual de rastreamento. O Kelet automatiza essa investigação agrupando padrões de falha em milhares de sessões.
Como funciona
- Você conecta seus rastreamentos e sinais (feedback do usuário, edições, cliques, sentimento, LLM-como-juiz, etc.)
- Kelet processa esses sinais e extrai fatos sobre cada sessão
- Ele forma hipóteses sobre o que deu errado em cada caso
- Ele agrupa hipóteses similares entre sessões e as investiga juntas
- Ele revela uma causa raiz com uma correção sugerida que você pode revisar e aplicar
A percepção chave: falhas individuais de sessão parecem aleatórias, mas quando você agrupa as hipóteses, padrões de falha emergem.
Opções de integração
Três formas de integrar:
- Habilidade Kelet para agentes de programação: Examina sua base de código, descobre onde os sinais devem ser coletados e configura tudo automaticamente
- SDK Python:
pip install kelet - SDK TypeScript:
npm install kelet
A configuração manual requer adicionar duas linhas ao seu código do agente. Kelet é totalmente compatível com OpenTelemetry, então qualquer agente instrumentado com OTEL funciona imediatamente.
Frameworks e Plataformas Suportados
Funciona com: OpenTelemetry, Langfuse, Mixpanel, OpenAI, Anthropic, LangChain, pydantic AI SDK, CrewAI, Strands, Agno, Mastra, PostHog, LangGraph, AutoGen, LlamaIndex, Haystack, Semantic Kernel e APIs Gemini.
Funciona com qualquer agente ou aplicação de LLM onde você possui o código: loops agenticos, fluxos de trabalho multi-etapas, pipelines RAG, chatbots, agentes autônomos.
Duas situações onde Kelet não é adequado:
- Se você usa ferramentas de IA construídas por outros (Cursor, Claude Code, Copilot como desenvolvedor)
- Se você está construindo uma habilidade ou plugin dentro de uma plataforma agentica existente
Detalhes Técnicos
- Executa nos servidores do Kelet (certificado SOC 2)
- Ingere rastreamentos continuamente 24/7
- Tokens LLM para análise são cobertos pelo Kelet (não afeta sua conta de API do modelo)
- Precificação baseada no uso (veja kelet.ai/pricing)
- Atualmente gratuito durante a beta (não requer cartão de crédito)
Métricas de Desempenho
Dados da coorte piloto:
- 73% das equipes tinham falhas que ninguém notou (Kelet as encontrou)
- 14.3 minutos tempo mediano desde ingestão de rastreamento até correção do prompt
- 33K+ sessões analisadas em implantações de parceiros de design
📖 Read the full source: HN AI Agents
👀 See Also

O desenvolvedor cria um agente de pesquisa de IA local que gera podcasts a partir de tópicos ou links do YouTube
Um desenvolvedor criou um agente de IA totalmente local que recebe tópicos ou links do YouTube e gera relatórios aprofundados, roteiros de podcasts conversacionais e áudio. O sistema pesquisa dinamicamente, extrai insights, refina resumos e cria conversas naturais de ida e volta.

Configuração do OpenClaw Headless com Discord via Scripts Docker
Um repositório no GitHub fornece scripts para executar o OpenClaw com Discord em um contêiner Docker headless, evitando a TUI/WebUI. Inclui um script de gerenciamento com comandos como claw init, start e stop, além de suporte pré-configurado para a API de Respostas da OpenAI, Chromium e várias ferramentas.

Optio: Orquestrando Agentes de Codificação de IA no Kubernetes do Chamado ao PR
Optio é um sistema de orquestração de código aberto que transforma tickets em pull requests mesclados usando agentes de codificação com IA como Claude Code ou Codex. Ele gerencia todo o ciclo de vida em pods Kubernetes isolados com um loop de feedback que reinicia automaticamente os agentes em falhas de CI ou feedback de revisão.

Calmkeep: Uma Camada de Continuidade Externa para Combater a Deriva de LLM em Sessões Estendidas
Calmkeep é uma camada de continuidade externa projetada para neutralizar a deriva de LLMs em sessões prolongadas, apresentando 85% de integridade contra 60% do Claude padrão em um teste de construção de backend de 25 turnos e 100% contra 50% em uma sessão jurídica.