LLMマトリックス:コミュニティ投票によるモデル比較、Claude Codeで構築

開発者がLLM Matrixというウェブサイトを作成しました。このツールは、複数の次元で大規模言語モデルを閲覧し投票できるようにし、中央集権的なベンチマークサイトへの懸念に対処するために、コミュニティ主導のランキングを実装しています。
LLM Matrixの機能
- 2からN次元でLLMスコアを同時に閲覧
- ユーザーがモデルに投票し、その投票がランキングを形成
- 初期データは公開インターネットソースから集計したスコアに基づき、モデルごとにわずか20票でシード
- 残りの投票とランキングはコミュニティの入力によって決定
開発詳細
このプロジェクト全体はClaude Codeを使用して構築されました。開発者は特に、開発に不可欠だった2つのプラグインを挙げています:
- production-gradeプラグイン:
https://github.com/nagisanzenin/claude-code-production-grade-plugin - claude-memプラグイン:
https://github.com/thedotmack/claude-mem
このサイトは現在llm-matrix.vercel.appでホストされており、潜在的に偏った中央集権的な指標よりもコミュニティの合意を優先する、LLM評価への代替的アプローチを表しています。
📖 完全なソースを読む: r/ClaudeAI
👀 See Also

各セッションでClaude Codeに再教育するのをやめよう:永続設定を使う
Redditユーザーが、Claude Code用の永続的な設定ファイルを作成することで、毎回のセッションで20分を節約し、33%高速な完了を実現した方法を説明しています。

Claudeを使用してCapacitor WebViewsでモバイルアプリのQAを自動化する
ある開発者が、CapacitorベースのモバイルアプリをAndroidとiOSでテストするためにClaudeを使用した自動QAシステムを構築しました。このアプローチでは、Android WebViewにはChrome DevTools Protocolを、スクリーンショットによる視覚的分析を採用しており、Androidのセットアップは90分で完了したのに対し、iOSには6時間以上を要しました。

Microsoft DebugMCP VS Code拡張機能がAIエージェントにデバッグ機能を提供
Microsoft DebugMCPは、Model Context Protocol(MCP)を介してAIコーディングエージェントに完全なVS Codeデバッガーを公開するVS Code拡張機能であり、ブレークポイントの設定、コードのステップ実行、変数の検査、式の評価を可能にします。

エージェンティックストア MCP: Claude Desktop用Pythonツールキット、27のローカルツールを搭載
AgenticStore MCPは、複数のMCPサーバーを単一のインストールで置き換えるオープンソースのPythonツールキットです。DockerやNode.jsの設定を必要とせず、永続的なメモリ、ウェブ検索、リポジトリ監査を含む27のローカルツールをClaude Desktopに提供します。