Queuelo: Eine schlanke Genehmigungs-API für LLM-Agenten

Queuelo ist eine leichtgewichtige Genehmigungs-API, die für LLM-Agenten in der Produktion entwickelt wurde. Sie bietet eine einfache HTTP-basierte Schicht, in der Agenten vor der Ausführung potenziell irreversibler Aktionen pausieren können, wobei eine menschliche Genehmigung erforderlich ist.
Wie es funktioniert
Das System arbeitet über einen einfachen HTTP-Fluss. Ihr LLM-Agent stellt eine POST-Anfrage an die Queuelo-API mit Aktionsdetails. Sie erhalten eine Benachrichtigung, überprüfen die Anfrage und genehmigen oder lehnen sie ab. Der Agent erhält dann die Entscheidung per Webhook zurück.
Technische Implementierung
Die API erfordert keine spezifischen Frameworks oder SDKs – nur HTTP. Hier ist der Beispiel-curl-Befehl aus der Quelle:
curl -X POST https://queuelo.com/api/actions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"action_type": "send_email", "summary": "Follow up with 500 leads", "risk_level": "high"}'Die Anfrage-Payload enthält drei Felder: action_type (z.B. "send_email"), summary (eine kurze Beschreibung) und risk_level (z.B. "high").
Kompatibilität
Queuelo funktioniert mit jedem Agenten-Framework, das HTTP-Anfragen stellen kann, einschließlich LangChain, CrewAI, AutoGen oder direkten API-Aufrufen. Der Ersteller erwähnt ausdrücklich, dass es für "jedes Agenten-Framework" entwickelt wurde und "wenn es eine HTTP-Anfrage stellen kann, kann es Queuelo nutzen".
Verfügbarkeit
Eine kostenlose Stufe ist verfügbar. Der Ersteller sucht aktiv nach Feedback darüber, welche Aktionstypen in Produktionsumgebungen verwendet werden.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Flash-MOE-Benchmark auf dem M5 Max: 12.99 Tok/s mit Qwen3.5-397B
Ein Benchmark des 397-Milliarden-Parameter-Modells Qwen3.5, das lokal auf einem MacBook Pro M5 Max mit 128 GB RAM läuft, erreichte 12,99 Token pro Sekunde mit 4-Bit-Quantisierung und Cache-IO-Split 4, was dreimal schneller ist als der ursprüngliche Benchmark mit 48 GB.

Ihr Fair-Share-Tool: Berechnen Sie Ihren gerechten Anteil am Unternehmensgewinn
Ein Entwickler hat ein Webtool mit Claude Code und Vercel erstellt, das berechnet, wie hoch Ihr gerechter Anteil am Jahresgewinn Ihres Arbeitgebers wäre, basierend auf SEC 10-K-Einreichungen. Das Tool zeigt konkrete Zahlen wie Apples 747.000 US-Dollar pro Mitarbeiter und NVIDIAs 2,8 Millionen US-Dollar pro Mitarbeiter.

Caddie: Slack-basierte Alternative zu OpenClaw startet nächste Woche
Caddie ist eine Slack-basierte Version von OpenClaw, die keine lokale Installation oder MCP-Konfiguration erfordert. Nutzer autorisieren es in 60 Sekunden über den Slack App Directory und geben dann Befehle ein, um Aufgaben in Gmail, LinkedIn, CRM, Kalender und über 100 weiteren Tools zu automatisieren.

PromoClock: Zeitzonen-Tracker für Claudes 2x Off-Peak-Stunden, erstellt mit Claude 4.6
Ein Entwickler hat PromoClock.co erstellt, ein kostenloses Tool, das Claudes "5-11 Uhr PT / 12-18 Uhr GMT" 2x Off-Peak-Promostunden automatisch in die lokale Zeit umwandelt, wobei Claude 4.6 für die Zeitzonenlogik, Next.js 15 für das Setup und das UI-Design verwendet wird.