マインドウォーク:Claude Code/Codexセッションを3Dコードマップ上の光跡として再生する

Mindwalkは、コードベースを3Dマップ上で再現し、コーディングエージェントのセッションを可視化するツールです。生のJSONLセッションログを見る代わりに、エージェントが検索、読み取り、編集するにつれて光が移動するナイトマップが表示され、未操作の部分は暗いままです。
解決する課題
セッションログはエージェントが何をしたかは教えてくれますが、タスクをどのように理解したか(リポジトリのどの部分を関連とみなしたか、行動前にどこを探索したか、フットプリントが意図と一致したか)はわかりません。JSONLを1行ずつ読んでも答えは得られません。
クイックスタート
curl -fsSL https://raw.githubusercontent.com/cosmtrek/mindwalk/master/scripts/install.sh | sh
export PATH="$HOME/.local/bin:$PATH"
mindwalkインストーラはchecksums.txtに対してバイナリを検証し、~/.local/binにインストールします(INSTALL_DIRで上書き可能。VERSIONでリリースを指定)。Windows用アーカイブはGitHub Releasesから入手できます。ソースからビルドする場合: make setup && make build → bin/mindwalk。
コマンド
引数なしで実行すると、~/.claude/projectsと~/.codex/sessionsをスキャンし、ランダムなローカルポートでUIを提供し、ブラウザを開きます:
mindwalk serve [--port N] [--no-open] [--claude-dir DIR] [--codex-dir DIR]mindwalk open [--no-open] <session.jsonl>— 特定のセッションを開くmindwalk build <repo> [-o out]— リポジトリのシティマップJSONを書き出すmindwalk trace <session> [-o out]— 正規化されたトレースJSONを書き出す
可視化の読み方
- ツリー / テライン表示 — リポジトリを放射状ツリーまたはツリーマップで表示。発光強度はファイルが触れられた深さと頻度に比例。
- タッチ状態 — 各ファイルは最も深いタッチを保持:見た(モスグリーン)、読んだ(ムーンホワイト)、編集した(ウォームアンバー)、未訪問(ダーク)。
- HUDは摩擦シグナルを折り畳む — エラー率、チャーンしたファイル、最終検証後の編集などをレビューストリップにまとめる。
- 再生デッキ — バケット化されたヒストグラムをスクラブまたは再生。クール/ウォームスペクトルのバー:観察(検索、読み取り、実行)はクール、変更(編集、検証)はウォームに発光。
- タイムラインマーク — ◇コンテキスト圧縮、○サブエージェント起動、›ユーザーターン。クリックでジャンプ。
- インスペクタ — ファイルをクリックして訪問履歴をピン留め。訪問行をクリックして再生ヘッドをジャンプ。
- キーボード: Space再生/一時停止 · ←/→ステップ(⇧×10) · Home/End終端 · S速度 · E次の編集 · X次のエラー · M次のマーク · ⌘Bセッションレール。
内部構造
2つの別個のアーティファクト: トレース(セッションログからのファイルタッチイベントの正規化されたストリーム、internal/adapterのアダプタ経由)とシティマップ(internal/citymap内のリポジトリの決定論的レイアウト)。ローカルのGoサーバー(internal/server)がこれらを結合し、React/Three.jsフロントエンド(web)を提供します。スキーマ契約はschema/にあります。
同じツリーは常に同じマップを生成するため、セッション間で再生を比較できます。セッションデータがマシンを離れることはありません—完全にローカルです。
📖 フルソースを読む: HN LLM Tools
👀 See Also

Redditでの議論:適切なモデルアーキテクチャなしでは、AI従業員の人格安定性にIdentity.mdファイルは不十分
Redditの議論では、基盤となるモデルアーキテクチャが役割分離をシミュレートするだけで、真の境界を強制できない場合、アイデンティティ.mdファイルを調整してAI従業員チームの人格混入を防ぐことは効果的ではないと主張されています。この投稿では、100回以上の自己進化サイクルを通じて基本トレーニングに境界認識を組み込んだMinimax M2.7バックエンドの使用を推奨しています。

Claude Codeは、LLMを用いて4,000件以上の盲人狼ゲームをシミュレートするために使用されました。
開発者がClaude Codeを使用して、大規模言語モデルが互いにブラインド・ワンナイト人狼をプレイするシミュレーターを構築し、OpenAIとxAIのモデルで約4,600ゲームを実行しました。この実験では、ゲームのシグナルが最小限であるにもかかわらず、名前ベースの投票パターンが一貫して現れることが明らかになりました。

civStation: Civilization VIの自然言語制御のためのオープンソースVLMハーネス
civStationは、Civilization VIを音声と自然言語で制御するためのオープンソースのコンピュータ利用スタックであり、VLMベースの観測と実行ループを通じて高レベルの戦略コマンドをUI操作に変換します。

実世界での比較:OpenClawセットアップにおけるOpus 4.6対MiMo-V2-Pro対GLM-5
開発者が、トルコ語の慣用句翻訳、Pythonコーディング、空間推論、ブラウザ自動化を含む実践的なタスクで3つのAIモデルをテストしました。MiMo-V2-ProはコーディングタスクでOpus 4.6を上回り、コストは20分の1でしたが、Opusは非英語の言語理解で優位性を維持しました。