Culpa: AIエージェントデバッグのためのオープンソース決定性リプレイエンジン

Culpaは、AIエージェントセッションのデバッグに特化して設計されたオープンソースの決定論的再生エンジンです。このツールが解決する中核的な問題は、LLMエージェントの非決定論的な性質です。エージェントが失敗した場合、セッションを単に再実行するだけでは正確な失敗を再現できません。
仕組み
このツールは、エージェントセッション中にすべてのLLM呼び出しと完全な実行コンテキストを記録します。失敗をデバッグする必要がある場合、新しいAPI呼び出しを行う代わりに、記録された応答をスタブとして使用してセッションを再生します。これにより、再生は完全に決定論的になり、実際のAPIを呼び出さないためコストがかかりません。
主な機能
- プロキシモード: Claude CodeやCursorなどのツールと連携し、コード変更を必要としません
- Python SDK: 独自のエージェントを構築する開発者向けに利用可能
- APIサポート: AnthropicおよびOpenAI APIと互換性があります
- フォーク機能: 記録された任意の決定ポイントでフォークし、異なる応答を注入して、何が起こったかを確認できます
実用的な利点
再生では実際のAPI呼び出しの代わりに記録された応答を使用するため、デバッグセッションではAPIコストがゼロになります。再生の決定論的な性質により、LLM応答に内在するランダム性のために再現が不可能だった失敗を確実に再現して分析することが可能になります。
このプロジェクトは、特にエージェントワークフローを構築している開発者からのフィードバックを積極的に求めています。作成者はCS(コンピュータサイエンス)の新入生であり、ツールの改善を目指していると述べています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

OllamaのローカルLLM開発における再利用可能なGoコンポーネントの分析
開発者がOllamaのソースコードを調査したところ、純粋なGoトークンサンプラー、GGUFリーダー/ライター、モデル変換ツール、チャットテンプレートレンダリング、OpenAI互換性変換など、独立したGoコンポーネントがいくつか見つかりました。これらは個別のライブラリとしては利用できません。

TigrimOS v1.1.0とTiger CoWork v0.5.0がリリースされ、リモートエージェントスウォームと構成可能なガバナンス機能を搭載しました。
本日リリースされたTigrimOS v1.1.0とTiger CoWork v0.5.0は、リモートインスタンス間のスウォーム間通信と5つの設定可能なガバナンスプロトコルを追加しました。両方ともセルフホスト型で、無料かつオープンソースです。

開発者が共有するハイブリッドAIコーディングワークフロー:計画にはClaude、実行にはローカルモデル
開発者がClaude 3.5 Sonnetをタスク計画に、Ollama経由のローカルQwen2.5-Coderモデルをコード生成に使用するパイプラインを構築し、Claudeのみを使用する場合と比較して85%のトークン削減を達成しました。

ArayCode: 音声、マルチエージェントホットキー、Markdown UIを備えたOpenClaw用デスクトップCLIクライアント
ArayCodeはOpenClawをデスクトップCLIアプリに変え、音声I/O、マルチエージェントホットキー、テーマ、Spectre.ConsoleベースのMarkdown UIを提供。クラウドおよびローカルのSTT/TTSプロバイダをサポート。