Asistente de Enseñanza de IA de UIUC Ejecuta 11 Modelos en Paralelo para Respuestas en Menos de 2 Segundos

El Centro de Innovación en IA de UIUC ha lanzado un asistente docente de IA de código abierto para cursos de Ingeniería Eléctrica, disponible en HuggingFace Spaces. El sistema orquesta 11 modelos separados en paralelo para recuperación y generación de texto e imágenes, moderación y clasificación, logrando un tiempo de respuesta medio de 2 segundos.
Arquitectura
El asistente utiliza generación aumentada por recuperación (RAG) con una base de datos vectorial de Pinecone. Las fuentes de datos incluyen libros de texto, videos de clases (transcritos con Whisper) y foros de preguntas de estudiantes. El código base tiene licencia MIT y está listo para conectarse a tu propia base de datos de Pinecone.
Conjunto de datos RLHF
El equipo contrató a cinco estudiantes de Ingeniería Eléctrica para producir un conjunto de datos comparativos para RLHF, cubriendo el curso ECE 120 de UIUC. El conjunto de datos está disponible gratuitamente en HuggingFace: kastan/rlhf-qa-comparisons.
Evaluación
Cada nueva función desencadena una evaluación automática. El conjunto de datos de evaluación, escrito por ingenieros eléctricos expertos, se utiliza para generar respuestas de cada modelo. Luego, GPT-3 juzga si las respuestas generadas son "mejores" o "peores" que la verdad básica escrita por humanos. Limitación conocida: GPT-3 se evalúa a sí mismo y tiende a favorecer los resultados de GPT-3.
Inicio rápido
pip install -r requirements.txt
# Establece las claves API en run_ta_gradio.sh, luego:
bash run_ta_gradio.shConstruye tu propio índice de Pinecone usando los scripts proporcionados: libros de texto desde PDF, transcripciones de video desde Whisper o diapositivas de clases desde imágenes .jpg.
Archivos clave
main.py— agregación de modelosTA_gradio_ux.py— interfaz de Gradioprompting.py— plantillas de promptsevaluation.py— bucle de evaluación de GPT-3feedback.json— comentarios de usuarios recopilados
El repositorio contiene 146 commits, 57 estrellas y un diagrama del sistema que muestra el pipeline de modelos en paralelo.
📖 Lee la fuente completa: HN LLM Tools
👀 Ver también

Marco para Compañeros de IA en Slack, Operado Completamente desde Claude Code
ginnie-agents es un framework de código abierto para ejecutar agentes de IA autónomos con identidades de Slack, memoria de tres niveles, rutinas cron y horarios laborales, todo configurado y operado a través de Claude Code. Requiere Claude Code Max, Docker, Node 22+ y un workspace de Slack con permisos para crear apps.

ClawVibe: Un asistente de voz manos libres para iOS para agentes de IA con STT/TTS en el dispositivo
ClawVibe es una aplicación nativa de iOS que proporciona interacción por voz manos libres con agentes de IA durante los desplazamientos. Utiliza reconocimiento de voz y TTS en el dispositivo, admite CarPlay e incluye biometría de voz para filtrar el ruido de fondo. Solo se envía texto a través de la red.

Flujo de Trabajo de Agente de IA Local Usando OpenCode, FastMCP y DeepSeek-r1
Un desarrollador comparte su configuración de agente de IA local utilizando OpenCode con archivos AGENTS.md para prompts de sistema deterministas, FastMCP para exponer funciones locales, y DeepSeek-r1 vía Ollama para subagentes específicos como pruebas.

El complemento OpenClaw agrega memoria persistente con el servidor Engram.
Un desarrollador creó un complemento de TypeScript que conecta agentes OpenClaw con Engram, un servidor de memoria basado en Go que utiliza SQLite con búsqueda FTS5. El complemento proporciona 11 herramientas, 4 ganchos de ciclo de vida y una recuperación automática que inyecta recuerdos relevantes en los prompts antes de cada turno del agente.