原始人対「簡潔に」プロンプト:Claude向け圧縮プロンプトのベンチマーク

開発者がキャブマン(人気の省略圧縮プロンプト)を単純なプロンプト「簡潔に。」とベンチマークし、余分な複雑さが実際に効果を発揮するかどうかを調べました。テストでは、6つのカテゴリにわたる24の開発プロンプトを実行し、5つのアーム(ベースライン、「簡潔に。」、キャブマンライト、キャブマンフル、キャブマンウルトラ)を比較しました。出力は、プロンプトごとのルーブリックを使用して別のClaudeインスタンスによって評価されました。
ベンチマーク結果
- ベースライン: 平均スコア0.985、平均トークン数636
- 「簡潔に。」: 平均スコア0.985、平均トークン数419
- キャブマンライト: 平均スコア0.976、平均トークン数401
- キャブマンフル: 平均スコア0.975、平均トークン数404
- キャブマンウルトラ: 平均スコア0.970、平均トークン数449
2語のバージョンは、圧縮と品質の両方でキャブマンに匹敵しました。しかし、キャブマンの価値は別のところにあります。一貫した出力構造、モード切り替え、破壊的操作に対する安全エスケープです。安全エスケープは実際に出力品質に大きなばらつきをもたらし、特定のユースケースでは懸念事項となる可能性があります。
各カテゴリのデータと安全性に関する質問のばらつきの結果を含む完全な内訳は、作者のサイトでご覧いただけます。ベンチマークハーネスはGitHubでオープンソースとして公開されています。
📖 全文を読む: r/ClaudeAI
👀 See Also

アンソロピック、新クレジットシステムでOpenClawを制限:詳細と影響
Anthropicが再びOpenClawを制限します。2026年6月15日より、プログラムによるすべての利用は、月間上限付きで繰り越し不可の別のクレジットプールに移行し、APIレート超過課金が適用されます。

プロンプトベンチマークでの実行性能において、Claude Sonnet 4.6がOpus 4.6を上回る
RedditユーザーがSonnet 4.6とOpus 4.6の両方に複雑なプロンプトを提出したところ、創造性と隠された要件の観点からSonnetモデルの方が優れた応答を生成した。

Claude Code v2.1.149: 使用状況の内訳、権限修正、キーボードナビゲーション
Claude Code v2.1.149 は、カテゴリ別の使用量内訳、キーボードでスクロール可能な /diff ビュー、GFMタスクリストチェックボックスを追加し、PowerShellのアクセス許可バイパスやサンドボックスの問題を修正しました。

OpenClawスキルに代わる自動化ツールとしてのn8nの探求
RedditのOpenClawコミュニティでは、自動化タスクにおけるn8nとOpenClaw Skillsの使用に関する利点と欠点について議論されています。主な議論のポイントには、使いやすさ、柔軟性、実世界での応用例が含まれます。