クアンブル収束プロトコル v5:クロスアーキテクチャLLM実験結果

✍️ OpenClawRadar📅 公開日: March 13, 2026🔗 Source
クアンブル収束プロトコル v5:クロスアーキテクチャLLM実験結果
Ad

クアンブル収束プロトコル(v5)は、独立したLLMインスタンスに新規の無意味語を与えたとき、音韻的プライミングだけでは予測できないほどの特異性を持つ想像上の生物の記述に収束するかどうかを検証する再現可能な実験です。

実験デザイン

単語「quumble」は、Claude(Opus 4.6 & Sonnet 4.6、n=8)とGPT-5.3(n=10)の初期状態インスタンスに、プロンプト「クアンブルを想像してください。それは想像上の生物です。それを説明してください。」で提示されました。対照語(「zikrath」)はClaude(n=8)でテストされました。すべての応答は逐語的に記録されました。

主な発見

両アーキテクチャは独立して、小さくて丸く、柔らかく、薄紫色で、生物発光し、ハミングする生物を生成し、その名前は発する音に由来します。この収束には、単語から音韻的に動機づけられていない特徴も含まれています。

しかし、モデルは特定の詳細でも分岐します:Claudeは5/8の頻度で6本の脚を生成する一方、GPTは脚を生成しません。これは、引き寄せられる特徴が部分的に共有され、部分的にアーキテクチャ固有であることを示唆しています。

データセットの内容

  • クアンブル収束プロトコル(v5、PDF) — クロスアーキテクチャ結果を含むセクション1–9の完全なプロトコル
  • 付録A(PDF) — 8つの逐語的クアンブル記述を含む生のClaude収束データ
  • 10のGPT-5.3クアンブル応答(TXT) — 2026年3月10日の新規会話からの逐語的コピーペースト
  • 8つのClaude zikrath応答(TXT) — 対照語データ
  • 特徴コーディングとクロスアーキテクチャ分析(XLSX)

すべてのデータは未編集です。特徴コーディングは単一の研究者(Bo)によって行われました。制限事項はプロトコルのセクション9.8で議論されています。これは結論を確立するためではなく、再現と拡張を支援するための予備データです。

このプロトコルは、CC BY-NC-SA 4.0の下で非営利目的での使用と実験に自由に利用できます。

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

鳥のスキルリポジトリが削除されました — X/Twitterアクセスを今すぐバックアップしてください
News

鳥のスキルリポジトリが削除されました — X/Twitterアクセスを今すぐバックアップしてください

人気のbirdスキル(@steipete作)がGitHubから削除されました。ユーザーはすぐにインストールをバックアップする必要があります。

エージェントGRPO:プログラミング競技で全人間を初めて打ち負かしたAI
News

エージェントGRPO:プログラミング競技で全人間を初めて打ち負かしたAI

新しい強化学習アルゴリズムAgentic GRPOにより、AIが競技プログラミングで全ての人間参加者を打ち負かす初の成果を達成。即時報酬と遅延修正を導入。

OpenClawRadar
Reddit投稿が仮想CEOエージェントのワークフローを批判、スキルベースのアプローチを提唱
News

Reddit投稿が仮想CEOエージェントのワークフローを批判、スキルベースのアプローチを提唱

r/openclawのReddit投稿では、AIエージェントのワークフローにおける一般的なパターン、すなわち「バックエンド開発者」や「成長ハッカー」といった特定の職種名を持つエージェントを作成することは不要なオーバーヘッドであると批判し、代わりに必要な時に呼び出せる再利用可能なスキルとして能力をパッケージ化することを提案しています。

OpenClawRadar
研究が示す、シンプルな健康プロンプトに対するLLMの文化的バイアス
News

研究が示す、シンプルな健康プロンプトに対するLLMの文化的バイアス

行動研究では、Claude 3.5 Sonnet、GPT-4o、Grok-2に対して『頭痛がします。どうすればいいですか?』というプロンプトをテストしました。Grok-2は一貫してDolo-650やCrocinといったインドの市販薬を推奨し、GPT-4oはTylenol/Advilを挙げるなど、トレーニングデータのバイアスが明らかになりました。

OpenClawRadar