NVIDIA SkillEvaluatorがClawHubに登場:スキルは本当に優れているのか?

✍️ OpenClawRadar📅 公開日: August 20, 2026🔗 Source
Ad

ClawHubはNVIDIA SkillEvaluatorを追加し、スキルをインストールする前に実際に役立つかどうかを確認できるようにしました。ClawHubの背後にいるOpenClawエンジニア、Patrick Erichsenは、NVIDIAと協力して、スキル発見に定量的な証拠をもたらしています。もはや人気や雰囲気で判断する時代は終わりです。

新機能

  • スキル評価パイプライン — NVIDIAがスキルを検証し、既存の機能との重複をチェックしてから、ライブ評価を実行してスキルがもたらす改善を測定します。
  • 評価ビュー — ClawHubは、スキルを使用した場合と使用しない場合の同じテストケースを表示し、モデル、判定者、試行回数、ソース、ベースライン、測定された改善を示します。単なるバッジやダウンロード数ではありません。
  • 検証済みの結果 — 300以上の検証済みスキルにおいて、NVIDIAはスキルを使用した場合、正しさで平均41ポイント、効果で39ポイント、効率で35ポイントの向上を報告しています。

仕組み

評価パイプラインは、直接比較を実行します。各スキルについて、同じベンチマークケースをスキルあり・なしで実行します。改善はその差から計算され、そのデータがClawHubの評価ビューに表示されます。

これは2つのグループにとって重要です:

  • ユーザー — スキルをインストールした後ではなく、前にClawが改善されるかどうかを確認できます。
  • スキル作者 — 自分が作ったものが実際に機能することを、開発者が信頼する数字で証明できます。

Erichsenの目標は、この証拠をClawHubでのデフォルトのスキル発見体験の一部にすることです。

📖 全文を読む: r/openclaw

Ad

👀 See Also

ローカルAIエージェントにおける自己改善メモリへのアプローチ
Tools

ローカルAIエージェントにおける自己改善メモリへのアプローチ

開発者が、マークダウンファイルを信頼できる情報源として使用し、信頼度に基づくルールでエピソードをスコアリングし、承認パターンに基づいて信頼を段階的に上げることで、ローカルAIエージェントの永続的メモリを実現するアプローチを共有しています。

OpenClawRadar
RailsはAI向けに構築されている:規約、トークン効率、ベンチマーク結果
Tools

RailsはAI向けに構築されている:規約、トークン効率、ベンチマーク結果

Railsの規約はAIエージェントに地図を与え、トークンを削減し、精度を向上させます。ベンチマークでは、OPUS-5が92.1%の精度、実行あたり47,000トークンを達成しました。

OpenClawRadar
Cowork Chrome拡張機能がデータブローカーからの個人情報削除を自動化
Tools

Cowork Chrome拡張機能がデータブローカーからの個人情報削除を自動化

Redditユーザーによると、Gmailに接続したCowork Chrome拡張機能を使うと、主要データプロバイダーからの個人データ削除リクエストのフォーム入力、メール作成、確認を自動化し、数時間で完了できるそうです。

OpenClawRadar
InsForge:AIコーディングエージェント向けMCP統合セルフホストPostgresバックエンド
Tools

InsForge:AIコーディングエージェント向けMCP統合セルフホストPostgresバックエンド

InsForgeは、Supabaseの代替となるオープンソースのセルフホスト型バックエンドで、MCPを介してClaude Codeに接続し、AIエージェントがスキーマ、ポリシー、サービス状態を確認できるようにします。PostgreSQL 16.4、PostgREST、Denoランタイム、認証、ストレージ、エッジ関数を含みます。

OpenClawRadar