WCYフォーマットは、LLMのトークンオーバーヘッドを50〜71%削減し、構造化された「わかりません」マーカーを追加します。

WCY(Watch → Compute → Yield)は、LLMのトークンオーバーヘッドを削減し、推論における不確実性の構造的マーカーを提供するために設計された行指向フォーマットです。JSONの括弧、引用符、カンマを1行1マーカーの構文に置き換えます。
トークン削減ベンチマーク
10-500行およびMCP交換タイプでのテスト結果:
- 構造化データ vs JSON:-50から-54%のトークン削減
- ツール呼び出しスキーマ:-65から-71%の削減
- 完全なMCPプロトコル交換:-61%の削減
- マルチエージェント出力トークン:-40%の削減
ファインチューニングは不要で、モデルがフォーマットを切り替えるには3つのfew-shot例で十分です。このアプローチにより、複雑なタスクでのparse_rメトリックは0.29から1.00に改善されます。
不確実性のための?マーカー
WCYは、LLMが推論中に知らないことを示す構造的な方法を導入します。?(void-B)スロットにより、モデルはインラインで不確実性を示すことができます:
: ?diagnosis hint=labs+imaging conf_range=0.4..0.8
order CT_scan reason=from=3 . CT_result mass_in_RUL size=2.3cm : diagnosis=adenocarcinoma conf=0.82 from=3,5テスト結果:
- ゼロショット:仕様がプロンプトにあっても、モデルは?マーカーを0%使用
- 3例の場合:トレースあたり5.4マーカー、67-97%解決
- 8ドメインの48パイプライントレース:95%解決率、100%品質ゲート合格
from=スロットは、どの観察がどの結論を支持するかをインラインで追跡し、幻覚連鎖の捕捉に役立ちます。
利用可能なリソース
- wcy_parser.py — 純粋なPython、外部依存なし
- wcy_eval.py — 3軸スコアリング(構造的/意味的/出典)
- void-Bサイクルを含む60の推論トレース(CC BY 4.0ライセンス、ファインチューニング実験用)
- 追加トレース生成用パイプラインスクリプト
これまでClaude Sonnetでのみテスト済み。著者は、同じfew-shot例でQwen、Llama、Mistralでも0%→5.4マーカーの結果が成立するか興味を持っています。
📖 Read the full source: r/LocalLLaMA
👀 See Also
クロードが終了すると破裂する風船: whisper.cppを用いた物理エージェントUI
デスクトップに浮かぶ風船に話しかけてタスクを指示すると、Claude Codeがエージェントとして実行され、完了時に風船が割れて紙吹雪が舞います。文字起こしはwhisper.cppでローカル実行、エージェントは既存のClaude Codeログインで動作。オープンソースです。

クロードの171内部感情ベクトルが出力に影響:Anthropic研究に基づくツールキット
Anthropicの研究論文によると、Claudeには感情ベクトルのように機能する171の内部活性化パターンがあり、文章を書く前にその行動を因果的に駆動しています。開発者はこれらの知見に基づき、7つの実用的なプロンプティング原則とシステムプロンプトを含むツールキットを作成しました。

オープンソースのJARVISデスクトップアシスタントをClaude Codeで2日間で構築
ある開発者が、Claude Codeを主要開発ツールとして使用し、1〜2日でmacOSデスクトップAIアシスタント「JARVIS」を構築しました。このアプリケーションは、ホログラフィックUI、システム制御のための18のネイティブツール、音声インターフェース、Gmail、Googleカレンダー、Notion、GitHub、Obsidianとの連携機能を備えています。

OpenClawマルチエージェント書籍執筆スキルがリリースされました
OpenClaw上に構築されたマルチエージェント書籍執筆システムがスキルとしてリリースされました。このツールは、DeepWiki MCP接続、イラスト用GLM画像生成、予算見積もり、章単位の修正機能を備えています。OpenClaw Paradigm Bookの2つの章がこのツールを使用して更新されました。