Lightpanda : navigateur headless open-source pour agents LLM avec serveur MCP natif et sortie en markdown

Lightpanda est un navigateur headless open-source spécialement conçu pour les flux de travail d'agents alimentés par LLM. Il répond à la nature gourmande en ressources des navigateurs traditionnels comme Chrome, qui consommait 2 Go avec 25 onglets parallèles et prenait 47 secondes pour crawler 933 pages dans les benchmarks. Lightpanda utilise 215 Mo et termine le même benchmark en 5 secondes en sautant le rendu CSS, le chargement d'images et la composition GPU dont les LLMs n'ont pas besoin.
Fonctionnalités clés pour les flux de travail LLM
- Sortie markdown native : Fonctionne à l'intérieur du moteur du navigateur, pas comme une étape de post-traitement. Les agents obtiennent un contenu propre et efficace en tokens après l'exécution de JavaScript.
- Arbre sémantique avec détection d'interactivité : Au lieu de HTML brut ou de captures d'écran, vous obtenez un DOM élagué avec des rôles, des XPaths et ce qui est réellement cliquable. Prend en charge un format texte compressé conçu pour une utilisation minimale de tokens.
- Extraction de données structurées : JSON-LD, Open Graph et balises meta en un seul appel.
- Serveur MCP natif : Intégré au binaire avec une configuration en trois lignes pour Claude, Cursor ou tout client MCP sans avoir besoin d'un pont CDP.
Outils MCP disponibles
Le serveur MCP fournit ces outils :
gotomarkdownsemantic_treeinteractiveElementsstructuredDatalinksevaluate(pour JavaScript arbitraire)
Cet outil est destiné aux développeurs construisant des agents alimentés par LLM qui ont besoin d'une interaction web efficace sans la surcharge d'un rendu complet du navigateur. L'approche est particulièrement utile pour le crawling web, l'extraction de données et les tâches d'automatisation où les agents doivent comprendre et interagir avec le contenu web.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Rivet Actors ajoute le stockage SQLite : une base de données par agent, locataire ou document
Rivet Actors prend désormais en charge le stockage SQLite où chaque acteur obtient sa propre base de données SQLite, permettant des millions de bases de données indépendantes pour les agents IA, les SaaS multi-locataires, les documents collaboratifs ou l'isolation par utilisateur.

Système de documentation auto-entretenu utilisant des blocs délimités pour un décalage zéro
Un développeur a créé un script bash qui extrait des données structurées directement des fichiers sources et les injecte dans CLAUDE.md via des blocs de commentaires HTML délimités, garantissant que la documentation reste synchronisée avec le code sans maintenance manuelle.

Freddy MCP Server : Donner à votre agent OpenClaw un accès en lecture aux données de santé personnelles
Freddy est un serveur de données de santé personnel qui expose sommeil, récupération, charge d'entraînement, etc. en tant que serveur MCP, permettant aux agents OpenClaw de raisonner sur des données réelles du corps.

Évaluation comparative de 88 petits modèles GGUF sur un Mac Mini M4 16 Go
Un pipeline automatisé a testé 88 modèles GGUF sur un Mac Mini M4 avec 16 Go de RAM, identifiant 9 comme inutilisables et 4 modèles LFM2-8B-A1B MoE sur la frontière de Pareto pour la vitesse et la qualité.