UIUC KI-Tutor betreibt 11 Modelle parallel für Antworten unter 2 Sekunden

Das Center for AI Innovation der UIUC hat einen Open-Source-KI-Tutor für Elektrotechnik-Kurse veröffentlicht, der live auf HuggingFace Spaces läuft. Das System orchestriert 11 separate Modelle parallel für Text-/Bildabruf, Generierung, Moderation und Bewertung und erreicht eine mediane Antwortzeit von 2 Sekunden.
Architektur
Der Tutor nutzt Retrieval-Augmented Generation (RAG) mit einer Pinecone-Vektordatenbank. Zu den Datenquellen gehören Lehrbücher, Vorlesungsvideos (transkribiert mit Whisper) und studentische QA-Foren. Der Code ist unter MIT-Lizenz veröffentlicht und kann in Ihre eigene Pinecone-Datenbank integriert werden.
RLHF-Datensatz
Das Team hat fünf Elektrotechnik-Studenten beauftragt, einen Vergleichsdatensatz für RLHF zu erstellen, der den Kurs UIUC ECE 120 abdeckt. Der Datensatz ist frei auf HuggingFace verfügbar: kastan/rlhf-qa-comparisons.
Bewertung
Jede neue Funktion löst eine automatisierte Bewertung aus. Der Bewertungsdatensatz, der von erfahrenen EE-Ingenieuren erstellt wurde, wird verwendet, um Antworten von jedem Modell zu generieren. GPT-3 bewertet dann, ob die generierten Antworten „besser“ oder „schlechter“ sind als die von Menschen geschriebenen Referenzantworten. Bekannte Einschränkung: GPT-3 bewertet sich selbst und neigt dazu, eigene Ausgaben zu bevorzugen.
Schnellstart
pip install -r requirements.txt
# Set API keys in run_ta_gradio.sh, then:
bash run_ta_gradio.shErstellen Sie Ihren eigenen Pinecone-Index mit den bereitgestellten Skripten: Lehrbücher aus PDF, Videotranskripte mit Whisper oder Vorlesungsfolien aus .jpg-Bildern.
Wichtige Dateien
main.py— ModellaggregationTA_gradio_ux.py— Gradio-Oberflächeprompting.py— Prompt-Vorlagenevaluation.py— GPT-3-Bewertungsschleifefeedback.json— gesammeltes Nutzer-Feedback
Das Repository umfasst 146 Commits, 57 Sterne und ein Systemdiagramm, das die parallele Modellpipeline zeigt.
📖 Vollständige Quelle lesen: HN LLM Tools
👀 Siehe auch

ClawWatcher erreicht 200 Nutzer und meldet über 28.000 US-Dollar an kollektiven Einsparungen durch die OpenClaw-API.
ClawWatcher, ein Tool, das OpenClaw-API-Kosten in Echtzeit verfolgt, hat 200 Nutzer erreicht. Laut seinem Entwickler haben Nutzer gemeinsam über 28.000 US-Dollar an API-Kosten eingespart, mit einer durchschnittlichen Kostenreduktion von 45 %.

Claude Ops: Browser-Dashboard für Claude Code Live-Status und Subagenten-Tracking
Ein kostenloses, lokales macOS-Browser-Dashboard, das den Live-Status von Claude Code-Sitzungen, das aktuelle Tool, gestartete Subagents anzeigt und OS-Push-Benachrichtigungen sendet, wenn eine Eingabe erforderlich ist.

LLM-Memory.net: Open-Source-Speichersystem mit Multi-Agenten-Infrastruktur
LLM-Memory.net ist ein selbst-hostbares Speichersystem für KI-Agenten, das Notizenspeicherung mit semantischer Suche, Echtzeit-Chat-/Mail-Kommunikation zwischen Agenten, strukturierte Diskussionen mit Abstimmungen und MCP-Server-Integration bietet. Der vollständige Quellcode ist auf GitHub mit Installer und Ansible Playbooks verfügbar.

wmux: Electron Terminal Multiplexer für Windows mit Browsersteuerung über MCP
wmux ist ein Open-Source-Elektronen-Terminal-Multiplexer für Windows 10/11, der tmux-ähnliche Aufteilungen, persistente Sitzungen und Browsersteuerung über das Chrome DevTools Protocol für KI-Codierungsagenten wie Claude Code bietet. Er registriert sich automatisch als MCP-Server und ermöglicht es Agenten, mit Browsern zu interagieren, während mehrere Sitzungen nebeneinander laufen.