LLMマトリックス:コミュニティ投票によるモデル比較、Claude Codeで構築

✍️ OpenClawRadar📅 公開日: March 8, 2026🔗 Source
LLMマトリックス:コミュニティ投票によるモデル比較、Claude Codeで構築
Ad

開発者がLLM Matrixというウェブサイトを作成しました。このツールは、複数の次元で大規模言語モデルを閲覧し投票できるようにし、中央集権的なベンチマークサイトへの懸念に対処するために、コミュニティ主導のランキングを実装しています。

LLM Matrixの機能

  • 2からN次元でLLMスコアを同時に閲覧
  • ユーザーがモデルに投票し、その投票がランキングを形成
  • 初期データは公開インターネットソースから集計したスコアに基づき、モデルごとにわずか20票でシード
  • 残りの投票とランキングはコミュニティの入力によって決定

開発詳細

このプロジェクト全体はClaude Codeを使用して構築されました。開発者は特に、開発に不可欠だった2つのプラグインを挙げています:

  • production-gradeプラグイン:https://github.com/nagisanzenin/claude-code-production-grade-plugin
  • claude-memプラグイン:https://github.com/thedotmack/claude-mem

このサイトは現在llm-matrix.vercel.appでホストされており、潜在的に偏った中央集権的な指標よりもコミュニティの合意を優先する、LLM評価への代替的アプローチを表しています。

📖 完全なソースを読む: r/ClaudeAI

Ad

👀 See Also

各セッションでClaude Codeに再教育するのをやめよう:永続設定を使う
Tools

各セッションでClaude Codeに再教育するのをやめよう:永続設定を使う

Redditユーザーが、Claude Code用の永続的な設定ファイルを作成することで、毎回のセッションで20分を節約し、33%高速な完了を実現した方法を説明しています。

OpenClawRadar
Claudeを使用してCapacitor WebViewsでモバイルアプリのQAを自動化する
Tools

Claudeを使用してCapacitor WebViewsでモバイルアプリのQAを自動化する

ある開発者が、CapacitorベースのモバイルアプリをAndroidとiOSでテストするためにClaudeを使用した自動QAシステムを構築しました。このアプローチでは、Android WebViewにはChrome DevTools Protocolを、スクリーンショットによる視覚的分析を採用しており、Androidのセットアップは90分で完了したのに対し、iOSには6時間以上を要しました。

OpenClawRadar
Microsoft DebugMCP VS Code拡張機能がAIエージェントにデバッグ機能を提供
Tools

Microsoft DebugMCP VS Code拡張機能がAIエージェントにデバッグ機能を提供

Microsoft DebugMCPは、Model Context Protocol(MCP)を介してAIコーディングエージェントに完全なVS Codeデバッガーを公開するVS Code拡張機能であり、ブレークポイントの設定、コードのステップ実行、変数の検査、式の評価を可能にします。

OpenClawRadar
エージェンティックストア MCP: Claude Desktop用Pythonツールキット、27のローカルツールを搭載
Tools

エージェンティックストア MCP: Claude Desktop用Pythonツールキット、27のローカルツールを搭載

AgenticStore MCPは、複数のMCPサーバーを単一のインストールで置き換えるオープンソースのPythonツールキットです。DockerやNode.jsの設定を必要とせず、永続的なメモリ、ウェブ検索、リポジトリ監査を含む27のローカルツールをClaude Desktopに提供します。

OpenClawRadar