原始人対「簡潔に」プロンプト:Claude向け圧縮プロンプトのベンチマーク

✍️ OpenClawRadar📅 公開日: April 29, 2026🔗 Source
原始人対「簡潔に」プロンプト:Claude向け圧縮プロンプトのベンチマーク
Ad

開発者がキャブマン(人気の省略圧縮プロンプト)を単純なプロンプト「簡潔に。」とベンチマークし、余分な複雑さが実際に効果を発揮するかどうかを調べました。テストでは、6つのカテゴリにわたる24の開発プロンプトを実行し、5つのアーム(ベースライン、「簡潔に。」、キャブマンライト、キャブマンフル、キャブマンウルトラ)を比較しました。出力は、プロンプトごとのルーブリックを使用して別のClaudeインスタンスによって評価されました。

ベンチマーク結果

  • ベースライン: 平均スコア0.985、平均トークン数636
  • 「簡潔に。」: 平均スコア0.985、平均トークン数419
  • キャブマンライト: 平均スコア0.976、平均トークン数401
  • キャブマンフル: 平均スコア0.975、平均トークン数404
  • キャブマンウルトラ: 平均スコア0.970、平均トークン数449

2語のバージョンは、圧縮と品質の両方でキャブマンに匹敵しました。しかし、キャブマンの価値は別のところにあります。一貫した出力構造、モード切り替え、破壊的操作に対する安全エスケープです。安全エスケープは実際に出力品質に大きなばらつきをもたらし、特定のユースケースでは懸念事項となる可能性があります。

各カテゴリのデータと安全性に関する質問のばらつきの結果を含む完全な内訳は、作者のサイトでご覧いただけます。ベンチマークハーネスはGitHubでオープンソースとして公開されています。

📖 全文を読む: r/ClaudeAI

Ad

👀 See Also

アンソロピック、新クレジットシステムでOpenClawを制限:詳細と影響
News

アンソロピック、新クレジットシステムでOpenClawを制限:詳細と影響

Anthropicが再びOpenClawを制限します。2026年6月15日より、プログラムによるすべての利用は、月間上限付きで繰り越し不可の別のクレジットプールに移行し、APIレート超過課金が適用されます。

OpenClawRadar
プロンプトベンチマークでの実行性能において、Claude Sonnet 4.6がOpus 4.6を上回る
News

プロンプトベンチマークでの実行性能において、Claude Sonnet 4.6がOpus 4.6を上回る

RedditユーザーがSonnet 4.6とOpus 4.6の両方に複雑なプロンプトを提出したところ、創造性と隠された要件の観点からSonnetモデルの方が優れた応答を生成した。

OpenClawRadar
Claude Code v2.1.149: 使用状況の内訳、権限修正、キーボードナビゲーション
News

Claude Code v2.1.149: 使用状況の内訳、権限修正、キーボードナビゲーション

Claude Code v2.1.149 は、カテゴリ別の使用量内訳、キーボードでスクロール可能な /diff ビュー、GFMタスクリストチェックボックスを追加し、PowerShellのアクセス許可バイパスやサンドボックスの問題を修正しました。

OpenClawRadar
OpenClawスキルに代わる自動化ツールとしてのn8nの探求
News

OpenClawスキルに代わる自動化ツールとしてのn8nの探求

RedditのOpenClawコミュニティでは、自動化タスクにおけるn8nとOpenClaw Skillsの使用に関する利点と欠点について議論されています。主な議論のポイントには、使いやすさ、柔軟性、実世界での応用例が含まれます。

OpenClawRadar