Asistente de Enseñanza de IA de UIUC Ejecuta 11 Modelos en Paralelo para Respuestas en Menos de 2 Segundos

El Centro de Innovación en IA de UIUC ha lanzado un asistente docente de IA de código abierto para cursos de Ingeniería Eléctrica, disponible en HuggingFace Spaces. El sistema orquesta 11 modelos separados en paralelo para recuperación y generación de texto e imágenes, moderación y clasificación, logrando un tiempo de respuesta medio de 2 segundos.
Arquitectura
El asistente utiliza generación aumentada por recuperación (RAG) con una base de datos vectorial de Pinecone. Las fuentes de datos incluyen libros de texto, videos de clases (transcritos con Whisper) y foros de preguntas de estudiantes. El código base tiene licencia MIT y está listo para conectarse a tu propia base de datos de Pinecone.
Conjunto de datos RLHF
El equipo contrató a cinco estudiantes de Ingeniería Eléctrica para producir un conjunto de datos comparativos para RLHF, cubriendo el curso ECE 120 de UIUC. El conjunto de datos está disponible gratuitamente en HuggingFace: kastan/rlhf-qa-comparisons.
Evaluación
Cada nueva función desencadena una evaluación automática. El conjunto de datos de evaluación, escrito por ingenieros eléctricos expertos, se utiliza para generar respuestas de cada modelo. Luego, GPT-3 juzga si las respuestas generadas son "mejores" o "peores" que la verdad básica escrita por humanos. Limitación conocida: GPT-3 se evalúa a sí mismo y tiende a favorecer los resultados de GPT-3.
Inicio rápido
pip install -r requirements.txt
# Establece las claves API en run_ta_gradio.sh, luego:
bash run_ta_gradio.shConstruye tu propio índice de Pinecone usando los scripts proporcionados: libros de texto desde PDF, transcripciones de video desde Whisper o diapositivas de clases desde imágenes .jpg.
Archivos clave
main.py— agregación de modelosTA_gradio_ux.py— interfaz de Gradioprompting.py— plantillas de promptsevaluation.py— bucle de evaluación de GPT-3feedback.json— comentarios de usuarios recopilados
El repositorio contiene 146 commits, 57 estrellas y un diagrama del sistema que muestra el pipeline de modelos en paralelo.
📖 Lee la fuente completa: HN LLM Tools
👀 Ver también

Kstack: Paquete de habilidades para Claude Code para monitorear y solucionar problemas de Kubernetes
Kstack es un paquete de habilidades de código abierto que añade comandos de barra como /investigate, /audit-security y /cluster-status a Claude Code (y otros agentes de IA) para monitorear y solucionar problemas en clústeres K8s. Utiliza kubectl, Kubetail, Trivy y Pluto en segundo plano.

Jan Agrega Instalación de OpenClaw con Un Solo Clic con Integración del Modelo Base Jan-v3
Jan ahora admite la instalación con un solo clic de OpenClaw con integración directa al modelo Jan-v3-base, manteniendo todas las operaciones locales y privadas en tu computadora.

Marky: Un Visor Ligero de Markdown para Documentación Generada por Agentes
Marky es un visor de markdown para escritorio desarrollado con Tauri v2 y React que abre archivos .md desde la terminal con recarga en vivo. Cuenta con uso prioritario desde CLI, resaltado de sintaxis con Shiki, soporte para matemáticas con KaTeX, diagramas Mermaid y espacios de trabajo para carpetas.

Claude Code delega la codificación a Mistral/DeepSeek: 57 millones de tokens ahorrados, reducción de costos del 90-100%
Una habilidad de Claude Code llamada vibe-skill delega la codificación de bajo nivel a modelos económicos como Mistral o DeepSeek, mientras mantiene la planificación de Claude. Después de 254 ejecuciones en 10 días, ahorró 57M de tokens y logró un 90-100% de ahorro de costos con una tasa de éxito del 98%.