LiteParse : Analyseur de documents rapide et open source pour agents IA

LiteParse est un analyseur de documents open-source axé sur une analyse locale rapide avec extraction spatiale du texte et boîtes englobantes. Il fonctionne entièrement localement sans dépendances cloud ni exigences GPU, traitant des centaines de pages en quelques secondes.
Fonctionnalités principales
- Outil open-source sous licence Apache 2.0
- Analyse spatiale du texte avec boîtes englobantes pour un positionnement précis du texte
- Aucune dépendance aux VLMs (Vision Language Models) locaux ou de pointe
- Fonctionne sur n'importe quelle machine sans exigences GPU
- Prend en charge plusieurs formats de fichiers : PDF, documents Office, images
- Précision supérieure à des outils similaires comme PyPDF, PyMuPDF, MarkItDown
- Installation en une ligne en tant que compétence pour plus de 40 agents IA, dont Claude Code, Cursor, OpenClaw, Windsurf
Options d'installation
Installation de l'outil CLI :
npm i -g @llamaindex/liteparse
Puis utilisez :
lit parse document.pdf
lit screenshot document.pdf
Pour macOS et Linux via Homebrew :
brew tap run-llama/liteparse
brew install llamaindex-liteparse
Installation de la compétence d'agent :
npx skills add run-llama/llamaparse-agent-skills --skill liteparse
Exemples d'utilisation
Analyse de base :
lit parse document.pdf
lit parse document.pdf --format json -o output.md
lit parse document.pdf --target-pages "1-5,10,15-20"
lit parse document.pdf --no-ocr
Analyse par lots :
lit batch-parse ./input-directory ./output-directory
Génération de captures d'écran (utile pour les agents LLM) :
lit screenshot document.pdf -o ./screenshots
lit screenshot document.pdf --target-pages "1,3,5" -o ./screenshots
lit screenshot document.pdf --dpi 300 -o ./screenshots
lit screenshot document.pdf --target-pages "1-10" -o ./screenshots
Utilisation de la bibliothèque
Installer en tant que dépendance :
npm install @llamaindex/liteparse
# ou
pnpm add @llamaindex/liteparse
Utilisation de base :
import { LiteParse } from '@llamaindex/liteparse';
const parser = new LiteParse({ ocrEnabled: true });
const result = await parser.parse('document.pdf');
console.log(result.text);
Entrée Buffer/Uint8Array (sans E/S disque) :
import { LiteParse } from '@llamaindex/liteparse';
import { readFile } from 'fs/promises';
const parser = new LiteParse();
const pdfBytes = await readFile('document.pdf');
const result = await parser.parse(pdfBytes);
Détails techniques
- Système OCR flexible avec Tesseract.js intégré (configuration zéro)
- Prend en charge les serveurs HTTP pour OCR (EasyOCR, PaddleOCR, personnalisés)
- Spécification d'API OCR standard
- Plusieurs formats de sortie : JSON et Texte
- Binaire autonome sans dépendances cloud
- Prise en charge multiplateforme : Linux, macOS (Intel/ARM), Windows
Pour les documents complexes avec des tableaux denses, des mises en page multi-colonnes, des graphiques, du texte manuscrit ou des PDF scannés, les créateurs recommandent LlamaParse, leur analyseur de documents basé sur le cloud conçu pour les pipelines de production de documents.
📖 Read the full source: HN AI Agents
👀 See Also

L'application de bureau Claude ajoute la fonctionnalité Projets à l'interface de collaboration
L'application de bureau Claude inclut désormais une fonctionnalité Projets dans Cowork, permettant aux utilisateurs d'organiser les tâches et le contexte dans des espaces de travail dédiés. Les fichiers et instructions restent sur l'ordinateur local de l'utilisateur, avec des options pour importer des projets existants ou en démarrer de nouveaux.

Vibe Remote : Pont Mobile pour l'Accès au Code Claude de N'importe Où
Vibe Remote est une application mobile qui permet d'accéder à distance aux environnements de développement Claude Code depuis un téléphone, permettant aux utilisateurs de conserver leurs configurations locales, leur historique Git et leur arborescence de fichiers sans nécessiter Tailscale ou des configurations VPN complexes.

Utilyze : Moniteur GPU Open Source qui mesure le débit de calcul réel, pas seulement l'activité du noyau
Utilyze échantillonne les compteurs de performance matériels pour rapporter le débit de calcul et de mémoire par rapport aux limites théoriques, révélant que des tableaux de bord affichant une utilisation à 100 % peuvent n'atteindre que 1 à 10 % de débit réel.

Ctxpact : Proxy de Compactage de Contexte pour LLM Locaux
Ctxpact est un proxy compatible OpenAI qui compresse les entrées trop volumineuses pour les LLM locaux avec des fenêtres de contexte de 16k, en utilisant un pipeline à 3 étapes incluant des stratégies de DCP, de résumé et d'extraction. Les benchmarks montrent 110k tokens compressés à 12k avec une précision de compréhension de lecture de 8/8.