MathCode:一个具备Lean 4形式化的数学编码智能体

✍️ OpenClawRadar📅 公開日: August 17, 2026🔗 Source
Ad

MathCodeは、ターミナルベースのAIコーディングアシスタントで、Lean 4を使用して数学の問題を形式化し、証明します。自分でLeanコードを書く代わりに、平易な英語で問題を与えると、定理を生成し、証明を試みます。永続的なREPLと再利用可能な定理のライブラリを備えています。

主な機能

  • 永続的なLean REPL: 一度ウォームアップすれば、コンパイルチェックが約30秒から約0.4秒に短縮されます。
  • 定理ライブラリ: 証明された定理はすべて自動的に名前が付けられ、保存され、再利用のためにインポートできます。
  • 公理ライブラリ: 会話上の仮定を永続的な、コンパイルチェック済みのLean宣言として保存します。
  • Lean LSP統合: leansearch.netとLoogleで検証済みのMathlib補題を検索し、構造化されたLSP診断を使用して修復します。
  • Obsidianの定理グラフ: Obsidianで定理と補題の視覚的な依存関係グラフを生成します。
  • エージェントモードの証明: エージェントがエラーに基づいて証明候補を反復処理する対話型セッション。
  • サブゴールのツリー: 複雑な定理を独立したサブゴールに分解し、並列で証明してから結合します。
  • マルチプランナー: 多様な証明戦略のために複数のプランナーを並列実行し、プローバーが最適なアプローチを選択します。

クイックスタート

macOS(arm64)またはLinux(x86_64)と、デフォルトのバックエンド用のcodex CLIが必要です。

git clone https://github.com/math-ai-org/mathcode.git
cd mathcode
bash setup.sh
codex auth login

次のように試してください:

mathcode -p "prove that the square of an even number is even"

出力はLeanFormalizations/に書き込まれます。ブラウザUIは./run webuiで利用できます。

このツールは、形式検証やAI支援の定理証明に取り組む数学者、研究者、開発者を対象としています。

📖 全文を読む: HN AI Agents

Ad

👀 See Also

GLM-5.1対MiniMax M2.7:AIコーディングエージェントの性能比較
Tools

GLM-5.1対MiniMax M2.7:AIコーディングエージェントの性能比較

GLM-5.1はSWE-bench-Verifiedで77.8、Terminal Bench 2.0で56.2のスコアを達成し、オープンソースモデルの中で最高の性能を示しています。一方、MiniMax M2.7は低いTTFTと高いスループットで高速な応答を実現し、CIボットやバッチ編集に最適です。

OpenClawRadar
LoreConvo: MCPサーバーがClaude Codeに永続セッションメモリを追加
Tools

LoreConvo: MCPサーバーがClaude Codeに永続セッションメモリを追加

LoreConvoは、Claude Codeに永続的なセッションメモリを提供するMCPサーバーで、セッション間のコンテキストを自動的に保存・読み込みします。再コンテキスト化のオーバーヘッドを排除することで、セッションごとに3,000〜8,000トークンを節約します。

OpenClawRadar
🦀
Tools

ローカルファーストMarkdownメモリサーバー(AIエージェント向け)の調査:Mem0、Hindsight、Zep、そして新参者Engram

あるユーザーが、編集可能なファイルとして記憶を保存するためのローカルエージェントメモリシステムを約20個テストしました。Engram(Obsidian68製)だけが、完全ローカル、Markdown保存、スマート重複除去、重要度減衰、スタンドアロンサーバーのすべての要件を満たしました。

OpenClawRadar
hipEngine: RDNA3向け高速ネイティブQwen 3.6推論(Strix Halo、7900 XTX)
Tools

hipEngine: RDNA3向け高速ネイティブQwen 3.6推論(Strix Halo、7900 XTX)

hipEngineは、RDNA3 GPU向けの新しいオープンソース(AGPLv3)でROCmネイティブなQwen 3.6 MoE推論エンジンです。ベンチマークでは7900 XTXで最大2718 tok/sのプリフィルを達成し、llama.cppと競合。INT8 KVキャッシュにより、24GB未満で256Kコンテキスト全体を処理可能です。

OpenClawRadar