Queuelo: Una API Liviana de Aprobación para Agentes LLM

Queuelo es una API de aprobación ligera diseñada para agentes de LLM que operan en producción. Proporciona una capa simple basada en HTTP donde los agentes pueden pausar antes de ejecutar acciones potencialmente irreversibles, requiriendo aprobación humana.
Cómo Funciona
El sistema opera a través de un flujo HTTP sencillo. Tu agente de LLM realiza una solicitud POST a la API de Queuelo con los detalles de la acción. Tú recibes una notificación, revisas la solicitud y la apruebas o rechazas. El agente luego recibe la decisión a través de un webhook.
Implementación Técnica
La API no requiere frameworks o SDKs específicos—solo HTTP. Aquí está el comando curl de ejemplo de la fuente:
curl -X POST https://queuelo.com/api/actions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"action_type": "send_email", "summary": "Follow up with 500 leads", "risk_level": "high"}'El payload de la solicitud incluye tres campos: action_type (ej. "send_email"), summary (una breve descripción), y risk_level (ej. "high").
Compatibilidad
Queuelo funciona con cualquier framework de agentes que pueda realizar solicitudes HTTP, incluyendo LangChain, CrewAI, AutoGen o llamadas API directas. El creador menciona específicamente que está diseñado para "cualquier framework de agentes" y "si puede hacer una solicitud HTTP puede usar Queuelo."
Disponibilidad
Hay un nivel gratuito disponible. El creador está buscando activamente comentarios sobre qué tipos de acciones están usando las personas en entornos de producción.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

ClaudyBro: Terminal nativo de macOS para flujos de trabajo de código con Claude
ClaudyBro es una aplicación nativa de terminal Swift de 3,5 MB construida específicamente para usuarios de Claude Code, que incluye pegado de imágenes, inspección de procesos, limpieza de huérfanos y gestión inteligente de MCP. Utiliza 68 MB de memoria en reposo y 82 MB con Claude en ejecución.

Auto Router vs Sonnet: Ahorro de Costos vs Calidad de Respuesta
La función Auto Router de Open Router selecciona dinámicamente modelos de lenguaje según la complejidad del contexto, ofreciendo ahorros significativos de costos (0.8 centavos vs 0.00071 centavos por solicitud), pero los usuarios reportan una calidad de respuesta degradada en comparación con Sonnet 4.6.
Encuesta de servidores de memoria Markdown local para agentes de IA: Mem0, Hindsight, Zep y el recién llegado Engram
Un usuario probó ~20 sistemas de memoria local para agentes que almacenan memorias como archivos editables. Engram (de Obsidian68) fue el único que cumplió con todos los requisitos: completamente local, almacenamiento en Markdown, deduplicación inteligente, decaimiento de importancia y servidor independiente.

Pruebas de referencia de tonterías: resistencia de LLM a indicaciones sin sentido
El Bullshit Benchmark evalúa si los modelos de IA identifican y rechazan indicaciones obviamente absurdas en lugar de generar respuestas incorrectas con confianza. Los resultados muestran que los modelos Claude tienen un rendimiento significativamente mejor que los modelos Gemini en la detección de preguntas sin sentido.