MathCode : un agent de codage mathématique avec formalisation Lean 4

✍️ OpenClawRadar📅 Publié: August 17, 2026🔗 Source
Ad

MathCode est un assistant IA de codage en terminal qui formalise et prouve des problèmes mathématiques en utilisant Lean 4. Au lieu d'écrire du code Lean vous-même, vous lui donnez un problème en anglais simple, et il génère un théorème et tente une preuve, avec un REPL persistant et une bibliothèque de théorèmes réutilisables.

Fonctionnalités clés

  • REPL Lean persistant : Après un échauffement unique, les vérifications de compilation passent à ~0,4 s (au lieu de ~30 s).
  • Bibliothèque de théorèmes : Chaque théorème prouvé est automatiquement nommé, stocké et importable pour réutilisation.
  • Bibliothèque d'axiomes : Stockez les hypothèses de conversation comme des déclarations Lean persistantes et vérifiées à la compilation.
  • Intégration LSP Lean : Recherche sur leansearch.net et Loogle pour des lemmes Mathlib vérifiés, utilise des diagnostics LSP structurés pour les réparations.
  • Graphe de théorèmes Obsidian : Génère un graphe de dépendances visuel des théorèmes et lemmes dans Obsidian.
  • Preuve en mode agent : Sessions interactives où l'agent itère sur des candidats de preuve en fonction des erreurs.
  • Arbre de sous-objectifs : Décompose les théorèmes complexes en sous-objectifs indépendants, les prouve en parallèle, puis les assemble.
  • Multi-planificateur : Exécute plusieurs planificateurs en parallèle pour diverses stratégies de preuve ; le prouveur choisit la meilleure approche.
Ad

Démarrage rapide

Nécessite macOS (arm64) ou Linux (x86_64), ainsi que l'interface CLI codex pour le backend par défaut.

git clone https://github.com/math-ai-org/mathcode.git
cd mathcode
bash setup.sh
codex auth login

Essayez avec :

mathcode -p "prouver que le carré d'un nombre pair est pair"

Les sorties sont écrites dans LeanFormalizations/. Une interface navigateur est disponible via ./run webui.

Cet outil est destiné aux mathématiciens, chercheurs et développeurs travaillant avec la vérification formelle ou la preuve de théorèmes assistée par IA.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Claude Code HUD : Tableau de bord terminal pour la surveillance des sessions de codage IA
Tools

Claude Code HUD : Tableau de bord terminal pour la surveillance des sessions de codage IA

claude-code-hud est un tableau de bord en terminal qui fournit une surveillance en temps réel des sessions Claude Code, affichant l'utilisation de la fenêtre contextuelle, les limites de débit de l'API et les modifications de fichiers sans nécessiter un IDE. Exécutez-le avec npx claude-code-hud.

OpenClawRadar
Outil de Création de Compétences pour OpenClaw Aide les Développeurs à Empaqueter des Flux de Travail
Tools

Outil de Création de Compétences pour OpenClaw Aide les Développeurs à Empaqueter des Flux de Travail

Un développeur a créé une compétence appelée skills-creator qui guide les utilisateurs dans la création de compétences de qualité pour OpenClaw, en abordant les écueils courants comme les descriptions vagues et les instructions ressemblant à de la documentation. Elle est disponible sur ClawHub et propose une approche axée sur la conception avec des formules de description, des listes de contrôle et des niveaux de complexité.

OpenClawRadar
🦀
Tools

TextGen (text-generation-webui) devient une application de bureau native avec des builds portables

TextGen, l'alternative open source à LM Studio, est passé d'une interface web à une application de bureau sans installation pour Windows, Linux et macOS avec des versions portables, une confidentialité totale et une prise en charge avancée de la quantification.

OpenClawRadar
Traduction en français : Modifications du flux de travail Claude Code UltraPlan et observations sur les performances
Tools

Traduction en français : Modifications du flux de travail Claude Code UltraPlan et observations sur les performances

Claude Code UltraPlan introduit un flux de travail de planification basé sur le cloud avec lancement depuis le terminal, interface de révision dans le navigateur et options d'exécution. Les tests ont montré des exécutions répétées environ 2 fois plus rapides que la planification locale, avec des améliorations de qualité variables.

OpenClawRadar