Матрица LLM: Сравнение моделей на основе голосов сообщества, созданное с помощью Claude Code

Разработчик создал LLM Matrix — веб-сайт, который позволяет пользователям просматривать и голосовать за большие языковые модели по нескольким измерениям. Этот инструмент решает проблему централизованных сайтов с бенчмарками, внедряя рейтинги на основе сообщества.
Что делает LLM Matrix
- Просмотр оценок LLM по 2 и более измерениям одновременно
- Пользователи голосуют за модели, и эти голоса формируют рейтинги
- Исходные данные содержат только 20 голосов на модель, основанных на агрегированных оценках из публичных интернет-источников
- Остальные голоса и рейтинги определяются вводом сообщества
Детали разработки
Весь проект был создан с использованием Claude Code. Разработчик специально упомянул два плагина, которые были необходимы для разработки:
- плагин production-grade:
https://github.com/nagisanzenin/claude-code-production-grade-plugin - плагин claude-mem:
https://github.com/thedotmack/claude-mem
Сайт в настоящее время размещён на llm-matrix.vercel.app и представляет альтернативный подход к оценке LLM, который отдаёт приоритет консенсусу сообщества над потенциально предвзятыми централизованными метриками.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Анамнез: Персональная система памяти для Claude через MCP
Anamnese — это бесплатный инструмент, который хранит личный контекст — факты, проекты, цели, задачи — и подключается к Claude через MCP, позволяя ИИ получать доступ к этой информации в начале каждого разговора.

Открытое хранилище в формате markdown обеспечивает Клоду постоянную память между сеансами.
Мой Портативный Мозг — это структура хранилища в формате markdown с уровнем выполнения агента, который предоставляет Claude постоянный контекст о личности, проектах, целях, CRM и еженедельных планах. Он работает нативно с Claude Code и Claude Cowork, использует простые файлы markdown и запускает фоновые скрипты каждую ночь для поддержания актуальности контекста.

llm-idle-timeout срабатывает через 2 минуты на N100/WSL2, несмотря на настройку timeoutSeconds
Пользователь сообщает, что сторожевой таймер простоя в OpenClaw срабатывает через 2 минуты на оборудовании N100/WSL2, игнорируя настройку timeoutSeconds=300, из-за медленного запуска шлюза (более 45 секунд) и отсутствия конфигурируемого параметра noOutputTimeoutMs.

Bifrost LLM Gateway: 11 микросекунд накладных расходов, единый бинарный файл на Go
Bifrost — это открытый прокси для LLM, написанный на Go, который маршрутизирует запросы к OpenAI, Anthropic, Azure и Bedrock с накладными расходами в 11 микросекунд на запрос, обрабатывая 5 000 RPS на VPS за $20 в месяц.