WCYフォーマットは、LLMのトークンオーバーヘッドを50〜71%削減し、構造化された「わかりません」マーカーを追加します。

WCY(Watch → Compute → Yield)は、LLMのトークンオーバーヘッドを削減し、推論における不確実性の構造的マーカーを提供するために設計された行指向フォーマットです。JSONの括弧、引用符、カンマを1行1マーカーの構文に置き換えます。
トークン削減ベンチマーク
10-500行およびMCP交換タイプでのテスト結果:
- 構造化データ vs JSON:-50から-54%のトークン削減
- ツール呼び出しスキーマ:-65から-71%の削減
- 完全なMCPプロトコル交換:-61%の削減
- マルチエージェント出力トークン:-40%の削減
ファインチューニングは不要で、モデルがフォーマットを切り替えるには3つのfew-shot例で十分です。このアプローチにより、複雑なタスクでのparse_rメトリックは0.29から1.00に改善されます。
不確実性のための?マーカー
WCYは、LLMが推論中に知らないことを示す構造的な方法を導入します。?(void-B)スロットにより、モデルはインラインで不確実性を示すことができます:
: ?diagnosis hint=labs+imaging conf_range=0.4..0.8
order CT_scan reason=from=3 . CT_result mass_in_RUL size=2.3cm : diagnosis=adenocarcinoma conf=0.82 from=3,5テスト結果:
- ゼロショット:仕様がプロンプトにあっても、モデルは?マーカーを0%使用
- 3例の場合:トレースあたり5.4マーカー、67-97%解決
- 8ドメインの48パイプライントレース:95%解決率、100%品質ゲート合格
from=スロットは、どの観察がどの結論を支持するかをインラインで追跡し、幻覚連鎖の捕捉に役立ちます。
利用可能なリソース
- wcy_parser.py — 純粋なPython、外部依存なし
- wcy_eval.py — 3軸スコアリング(構造的/意味的/出典)
- void-Bサイクルを含む60の推論トレース(CC BY 4.0ライセンス、ファインチューニング実験用)
- 追加トレース生成用パイプラインスクリプト
これまでClaude Sonnetでのみテスト済み。著者は、同じfew-shot例でQwen、Llama、Mistralでも0%→5.4マーカーの結果が成立するか興味を持っています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

オープンソースのAI求職システム「Claude Code」は、求人オファーを評価し、カスタマイズされた履歴書を生成します。
開発者が、ターミナルを求職コマンドセンターに変えるClaude Codeプロジェクトをオープンソース化しました。このシステムは求人情報を10の次元で評価し、ATS最適化PDF履歴書を生成、45以上の企業採用ページをスキャンし、14のスキルモードを備えています。

カスタムGIFスピナーをCOLRフォント変換でClaudeコード用に実装
ある開発者が、Claude Codeのデフォルトのスピナーを任意のアニメーションGIFに置き換える方法を公開しました。この手法では、GIFをOpenType COLRカラーフォントに変換し、アニメーションの各フレームをグリフとして表現し、Claude Codeのスピナーをパッチしてこれらのグリフを順番に表示するようにします。現在、このツールはWindowsに対応しており、macOS/Linux版も計画されています。

エージェントブラウザプロトコル:AIエージェント向けオープンソースChromeフォークがMind2Webベンチマークで90%を達成
Agent Browser Protocol(ABP)は、各アクション後にJavaScriptと時間を凍結することで、ウェブブラウジングをAIエージェント向けのマルチモーダルチャットに変換するオープンソースのChromeフォークです。Online Mind2Webベンチマークで90.53%を達成し、Claude Codeに単一のコマンドで追加できます。

Claude Code SkillがStitchデザインをピクセルずれゼロでNext.jsに変換
Claude Codeスキルは、Google Stitch AIのデザインをNext.jsコンポーネントに変換し、ピクセルずれを防ぐための必須検証チェックポイントを設けて、正確な値を保持し、アセットを処理します。