NVIDIA SkillEvaluatorがClawHubに登場:スキルは本当に優れているのか?
ClawHubはNVIDIA SkillEvaluatorを追加し、スキルをインストールする前に実際に役立つかどうかを確認できるようにしました。ClawHubの背後にいるOpenClawエンジニア、Patrick Erichsenは、NVIDIAと協力して、スキル発見に定量的な証拠をもたらしています。もはや人気や雰囲気で判断する時代は終わりです。
新機能
- スキル評価パイプライン — NVIDIAがスキルを検証し、既存の機能との重複をチェックしてから、ライブ評価を実行してスキルがもたらす改善を測定します。
- 評価ビュー — ClawHubは、スキルを使用した場合と使用しない場合の同じテストケースを表示し、モデル、判定者、試行回数、ソース、ベースライン、測定された改善を示します。単なるバッジやダウンロード数ではありません。
- 検証済みの結果 — 300以上の検証済みスキルにおいて、NVIDIAはスキルを使用した場合、正しさで平均41ポイント、効果で39ポイント、効率で35ポイントの向上を報告しています。
仕組み
評価パイプラインは、直接比較を実行します。各スキルについて、同じベンチマークケースをスキルあり・なしで実行します。改善はその差から計算され、そのデータがClawHubの評価ビューに表示されます。
これは2つのグループにとって重要です:
- ユーザー — スキルをインストールした後ではなく、前にClawが改善されるかどうかを確認できます。
- スキル作者 — 自分が作ったものが実際に機能することを、開発者が信頼する数字で証明できます。
Erichsenの目標は、この証拠をClawHubでのデフォルトのスキル発見体験の一部にすることです。
📖 全文を読む: r/openclaw
👀 See Also

ローカルAIエージェントにおける自己改善メモリへのアプローチ
開発者が、マークダウンファイルを信頼できる情報源として使用し、信頼度に基づくルールでエピソードをスコアリングし、承認パターンに基づいて信頼を段階的に上げることで、ローカルAIエージェントの永続的メモリを実現するアプローチを共有しています。

RailsはAI向けに構築されている:規約、トークン効率、ベンチマーク結果
Railsの規約はAIエージェントに地図を与え、トークンを削減し、精度を向上させます。ベンチマークでは、OPUS-5が92.1%の精度、実行あたり47,000トークンを達成しました。

Cowork Chrome拡張機能がデータブローカーからの個人情報削除を自動化
Redditユーザーによると、Gmailに接続したCowork Chrome拡張機能を使うと、主要データプロバイダーからの個人データ削除リクエストのフォーム入力、メール作成、確認を自動化し、数時間で完了できるそうです。

InsForge:AIコーディングエージェント向けMCP統合セルフホストPostgresバックエンド
InsForgeは、Supabaseの代替となるオープンソースのセルフホスト型バックエンドで、MCPを介してClaude Codeに接続し、AIエージェントがスキーマ、ポリシー、サービス状態を確認できるようにします。PostgreSQL 16.4、PostgREST、Denoランタイム、認証、ストレージ、エッジ関数を含みます。