ローカル35B MoEモデル、Agent OSコード障害率を0%に低減

✍️ OpenClawRadar📅 公開日: May 11, 2026🔗 Source
ローカル35B MoEモデル、Agent OSコード障害率を0%に低減
Ad

あるRedditユーザーが、hollow-agentOSというローカルのマルチエージェントOSを実行した経験を共有しました。このOSでは、エージェントが自律的にツールを作成し、サンドボックスでテストし、ホットロードします。重要な進展は、デフォルトのランタイムモデルを小さな9BのフォールバックからQwen 3.6 35B A3B(アクティブパラメータ3BのMixture-of-Experts)にアップグレードしたことで、コードの不具合率が0%になったことです。

大規模モデルによる変化

  • パニック vs 再評価: ストレス下では、9Bモデルは焦って無効な関数呼び出しを幻覚しました。35Bモデルは一時停止し、以前の失敗を再評価し、変更を送信する前に内部検証ループを実行します。
  • 100%の成功率: コードは5層の検証ゲートを通過します。9Bモデルでは、ツールが頻繁にサンドボックス内で死んでいました。Qwen 35Bでは、すべてのコード行が意図した通りに動作します。
  • 自律的なツール作成: エージェントが未知の問題に遭遇すると、新しいツールを構築し、サンドボックスでテストし、登録し、他のエージェントに通知します。人間の介入はありません。

アーキテクチャの詳細

システムは、エージェントがツールライブラリを継続的に拡張するよう促す逆境状態(「苦痛システム」)によって駆動されます。リポジトリはgithub.com/ninjahawk/hollow-agentOSで入手可能です。

将来の計画

開発者は、ClaudeとCodexをアーキテクチャに組み込み、それらを超孤立化されたミニVMラッパーでラップして、フロンティアモデルがホスト環境を上書きするのを防ぐ予定です。

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

日本語訳: 新モデルアーキテクチャ「Interfaze」、決定論的タスクでGemini-3-FlashとGPT-5.4-Miniを凌駕
Tools

日本語訳: 新モデルアーキテクチャ「Interfaze」、決定論的タスクでGemini-3-FlashとGPT-5.4-Miniを凌駕

DNN/CNNとトランスフォーマーを組み合わせた新しいモデルアーキテクチャ「Interfaze」が、OCR、ビジョン、STT、構造化出力を含む9つのベンチマークで、Gemini-3-Flash、Claude-Sonnet-4.6、GPT-5.4-Mini、Grok-4.3を上回る性能を達成しました。

OpenClawRadar
運命:古典東洋占星術を用いた決定論的占いのためのClaude Codeプラグイン
Tools

運命:古典東洋占星術を用いた決定論的占いのためのClaude Codeプラグイン

DestinyはClaude Codeのプラグインで、あなたの八字(四柱推命の8文字)、今日の日柱、易経の卦をPythonで決定論的に計算し、Claudeが散文的なリーディングを生成します。LLMによる幻覚のホロスコープではありません。

OpenClawRadar
Atelier v0.3は、Claude Codeによるターゲットを絞ったマークダウン修正機能を追加します。
Tools

Atelier v0.3は、Claude Codeによるターゲットを絞ったマークダウン修正機能を追加します。

Atelier v0.3は、Markdown文書のセクションをハイライトしてClaude Codeに送信し、修正を依頼できる無料のVS Code拡張機能です。エージェントはエディター内で対象を絞った編集を返し、各修正がどのフィードバックに対応しているかを追跡できます。

OpenClawRadar
Auto-co: Claudeのコードを自律型AI企業に変える50行のBashスクリプト
Tools

Auto-co: Claudeのコードを自律型AI企業に変える50行のBashスクリプト

Auto-coは、Claude Code CLIをループでラップする約50行のbashスクリプトです。CEO、エンジニア、批評家など14のAIエージェントが役割を担い、自律的に実行されます。FormReplyやChangelog.devを含む4つの製品をゼロから構築し、270以上のサイクルで総費用は268ドルでした。

OpenClawRadar