UIUCのAIティーチングアシスタントが11モデルを並行してサブ2秒の応答を実現

✍️ OpenClawRadar📅 公開日: July 19, 2026🔗 Source
UIUCのAIティーチングアシスタントが11モデルを並行してサブ2秒の応答を実現
Ad

UIUCのAIイノベーションセンターは、電気工学コース向けのオープンソースAI教育アシスタントを公開し、HuggingFace Spacesで稼働中です。このシステムは、テキスト/画像の検索、生成、モデレーション、ランキングのために11の個別モデルを並列実行し、中央値2秒の応答時間を達成しています。

アーキテクチャ

このアシスタントは、Pineconeベクトルデータベースを用いた検索拡張生成(RAG)を採用。データソースには、教科書、講義ビデオ(Whisperで文字起こし)、学生のQAフォーラムが含まれます。コードベースはMITライセンスで、自身のPineconeデータベースに接続可能です。

RLHFデータセット

チームは5人の電気工学学生を雇い、UIUCのECE 120コースを対象としたRLHF用の比較データセットを作成しました。データセットはHuggingFaceで公開されています:kastan/rlhf-qa-comparisons

評価

新機能が追加されるたびに自動評価が実行されます。EEエンジニアの専門家が作成した評価データセットを使用して、各モデルが回答を生成。GPT-3が生成回答を人間作成の正解と比較し、「良い」か「悪い」かを判定します。既知の制限:GPT-3は自身を評価するため、GPT-3の出力を好む傾向があります。

クイックスタート

pip install -r requirements.txt
# run_ta_gradio.shでAPIキーを設定後:
bash run_ta_gradio.sh

提供スクリプトを使用して独自のPineconeインデックスを構築:教科書(PDF)、ビデオ文字起こし(Whisper)、講義スライド(.jpg画像)から。

主要ファイル

  • main.py — モデル集約
  • TA_gradio_ux.py — Gradio UI
  • prompting.py — プロンプトテンプレート
  • evaluation.py — GPT-3評価ループ
  • feedback.json — 収集されたユーザーフィードバック

リポジトリは146コミット、57スター、並列モデルパイプラインを示すシステム図を含みます。

📖 出典全文: HN LLM Tools

Ad

👀 See Also

🦀
Tools

なぜコーディングエージェントはほとんどのタスクでLSPよりもgrepを好むのか

ある研究によると、コーディングエージェントは単純なタスクでは94〜100%の確率でLSPツールよりもgrepを選択するが、完全性が重要になる場合には切り替える。セマンティックパスを強制すると成功率が下がることがある。

OpenClawRadar
MCPサーバーは、AIエージェントを既存のChromeセッションに接続し、クッキーと認証情報を利用可能にします。
Tools

MCPサーバーは、AIエージェントを既存のChromeセッションに接続し、クッキーと認証情報を利用可能にします。

@playwright-repl/mcpは、Dramaturg拡張機能を介してAIエージェントを既存のChromeブラウザに接続するMCPサーバーで、クッキーや認証情報を含む実際のブラウザセッションへのアクセスを提供します。Playwright JavaScriptの完全なサポート、アサーション機能を備え、Claude Desktop、Claude Code、Cursor、または任意のMCPクライアントで動作します。

OpenClawRadar
素晴らしいオープンクロー・スキルリポジトリは、5,400以上の厳選されたスキルを提供しています。
Tools

素晴らしいオープンクロー・スキルリポジトリは、5,400以上の厳選されたスキルを提供しています。

awesome-openclaw-skillsというGitHubリポジトリは、公式OpenClaw Skills Registryからフィルタリングされた1,715以上の本番環境対応スキルを提供しており、AIエージェントが1つのCLIコマンドでインストールできます。

OpenClawRadar
Claudeを用いたObsidian用エージェント型RAGの構築と幻覚検出のための評価ハーネス
Tools

Claudeを用いたObsidian用エージェント型RAGの構築と幻覚検出のための評価ハーネス

ある開発者が、自身のObsidian Vault上にエージェンティックRAGシステムを構築し、Claudeが工学書の質問に回答できるようにした。さらに、Claude Sonnetを判定役とする評価ハーネスを作成し、エージェントが誤った内容を自信満々に出力するケースを検出できるようにした。ルーブリックの反復改良により、判定者と人間の一致率が39%から94%に向上した。

OpenClawRadar