Матрица LLM: Сравнение моделей на основе голосов сообщества, созданное с помощью Claude Code

✍️ OpenClawRadar📅 Опубликовано: 8 марта 2026 г.🔗 Source
Матрица LLM: Сравнение моделей на основе голосов сообщества, созданное с помощью Claude Code
Ad

Разработчик создал LLM Matrix — веб-сайт, который позволяет пользователям просматривать и голосовать за большие языковые модели по нескольким измерениям. Этот инструмент решает проблему централизованных сайтов с бенчмарками, внедряя рейтинги на основе сообщества.

Что делает LLM Matrix

  • Просмотр оценок LLM по 2 и более измерениям одновременно
  • Пользователи голосуют за модели, и эти голоса формируют рейтинги
  • Исходные данные содержат только 20 голосов на модель, основанных на агрегированных оценках из публичных интернет-источников
  • Остальные голоса и рейтинги определяются вводом сообщества

Детали разработки

Весь проект был создан с использованием Claude Code. Разработчик специально упомянул два плагина, которые были необходимы для разработки:

  • плагин production-grade: https://github.com/nagisanzenin/claude-code-production-grade-plugin
  • плагин claude-mem: https://github.com/thedotmack/claude-mem

Сайт в настоящее время размещён на llm-matrix.vercel.app и представляет альтернативный подход к оценке LLM, который отдаёт приоритет консенсусу сообщества над потенциально предвзятыми централизованными метриками.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Анамнез: Персональная система памяти для Claude через MCP
Инструменты

Анамнез: Персональная система памяти для Claude через MCP

Anamnese — это бесплатный инструмент, который хранит личный контекст — факты, проекты, цели, задачи — и подключается к Claude через MCP, позволяя ИИ получать доступ к этой информации в начале каждого разговора.

OpenClawRadar
Открытое хранилище в формате markdown обеспечивает Клоду постоянную память между сеансами.
Инструменты

Открытое хранилище в формате markdown обеспечивает Клоду постоянную память между сеансами.

Мой Портативный Мозг — это структура хранилища в формате markdown с уровнем выполнения агента, который предоставляет Claude постоянный контекст о личности, проектах, целях, CRM и еженедельных планах. Он работает нативно с Claude Code и Claude Cowork, использует простые файлы markdown и запускает фоновые скрипты каждую ночь для поддержания актуальности контекста.

OpenClawRadar
llm-idle-timeout срабатывает через 2 минуты на N100/WSL2, несмотря на настройку timeoutSeconds
Инструменты

llm-idle-timeout срабатывает через 2 минуты на N100/WSL2, несмотря на настройку timeoutSeconds

Пользователь сообщает, что сторожевой таймер простоя в OpenClaw срабатывает через 2 минуты на оборудовании N100/WSL2, игнорируя настройку timeoutSeconds=300, из-за медленного запуска шлюза (более 45 секунд) и отсутствия конфигурируемого параметра noOutputTimeoutMs.

OpenClawRadar
Bifrost LLM Gateway: 11 микросекунд накладных расходов, единый бинарный файл на Go
Инструменты

Bifrost LLM Gateway: 11 микросекунд накладных расходов, единый бинарный файл на Go

Bifrost — это открытый прокси для LLM, написанный на Go, который маршрутизирует запросы к OpenAI, Anthropic, Azure и Bedrock с накладными расходами в 11 микросекунд на запрос, обрабатывая 5 000 RPS на VPS за $20 в месяц.

OpenClawRadar