LiteParse: Быстрый открытый парсер документов для AI-агентов

✍️ OpenClawRadar📅 Опубликовано: 21 марта 2026 г.🔗 Source
LiteParse: Быстрый открытый парсер документов для AI-агентов
Ad

LiteParse — это инструмент с открытым исходным кодом для парсинга документов, ориентированный на быстрый локальный разбор с пространственным извлечением текста и ограничивающими рамками. Он работает полностью локально, без зависимостей от облачных сервисов или требований к GPU, обрабатывая сотни страниц за секунды.

Ключевые особенности

  • Инструмент с открытым исходным кодом под лицензией Apache 2.0
  • Пространственный парсинг текста с ограничивающими рамками для точного позиционирования
  • Не зависит от локальных или передовых VLM (Vision Language Models)
  • Работает на любой машине без требований к GPU
  • Поддерживает несколько форматов файлов: PDF, документы Office, изображения
  • Более высокая точность по сравнению с аналогичными инструментами, такими как PyPDF, PyMuPDF, MarkItDown
  • Установка одной командой в качестве навыка для более чем 40 ИИ-агентов, включая Claude Code, Cursor, OpenClaw, Windsurf

Варианты установки

Установка CLI-инструмента:

npm i -g @llamaindex/liteparse

Затем используйте:

lit parse document.pdf
lit screenshot document.pdf

Для macOS и Linux через Homebrew:

brew tap run-llama/liteparse
brew install llamaindex-liteparse

Установка навыка для агента:

npx skills add run-llama/llamaparse-agent-skills --skill liteparse

Примеры использования

Базовый парсинг:

lit parse document.pdf
lit parse document.pdf --format json -o output.md
lit parse document.pdf --target-pages "1-5,10,15-20"
lit parse document.pdf --no-ocr

Пакетный парсинг:

lit batch-parse ./input-directory ./output-directory

Создание скриншотов (полезно для LLM-агентов):

lit screenshot document.pdf -o ./screenshots
lit screenshot document.pdf --target-pages "1,3,5" -o ./screenshots
lit screenshot document.pdf --dpi 300 -o ./screenshots
lit screenshot document.pdf --target-pages "1-10" -o ./screenshots
Ad

Использование как библиотеки

Установка как зависимости:

npm install @llamaindex/liteparse
# или
pnpm add @llamaindex/liteparse

Базовое использование:

import { LiteParse } from '@llamaindex/liteparse';
const parser = new LiteParse({ ocrEnabled: true });
const result = await parser.parse('document.pdf');
console.log(result.text);

Ввод через Buffer/Uint8Array (без операций ввода-вывода на диск):

import { LiteParse } from '@llamaindex/liteparse';
import { readFile } from 'fs/promises';
const parser = new LiteParse();
const pdfBytes = await readFile('document.pdf');
const result = await parser.parse(pdfBytes);

Технические детали

  • Гибкая система OCR со встроенным Tesseract.js (без дополнительной настройки)
  • Поддерживает HTTP-серверы для OCR (EasyOCR, PaddleOCR, пользовательские)
  • Стандартная спецификация API для OCR
  • Несколько выходных форматов: JSON и Text
  • Автономный бинарный файл без облачных зависимостей
  • Поддержка нескольких платформ: Linux, macOS (Intel/ARM), Windows

Для сложных документов с плотными таблицами, многоколоночной вёрсткой, диаграммами, рукописным текстом или отсканированными PDF создатели рекомендуют LlamaParse, их облачный парсер документов, созданный для производственных конвейеров обработки документов.

📖 Read the full source: HN AI Agents

Ad

👀 Смотрите также

Постоянные индексы вместо извлечения: архитектура сервера MCP для YouTube
Инструменты

Постоянные индексы вместо извлечения: архитектура сервера MCP для YouTube

Разработчик делится архитектурными заметками по созданию YouTube MCP-сервера, который использует постоянные локальные индексы вместо распространённого паттерна «извлечь и забыть». Ключевые решения включают трёхуровневую систему резервирования, SQLite + sqlite-vec для векторного хранения, абстракцию провайдеров эмбеддингов и отдельный индекс визуального поиска.

OpenClawRadar
PixelCheck: npm-пакет, позволяющий ИИ-агентам визуально проверять веб-страницы
Инструменты

PixelCheck: npm-пакет, позволяющий ИИ-агентам визуально проверять веб-страницы

PixelCheck — это npm-пакет, который позволяет AI-агентам открывать, взаимодействовать и визуально оценивать веб-страницы — больше никаких ручных циклов со скриншотами и обратной связью.

OpenClawRadar
Клод Код против OpenCode: Ключевые технические различия, обнаруженные разработчиком
Инструменты

Клод Код против OpenCode: Ключевые технические различия, обнаруженные разработчиком

Разработчик сравнивает Claude Code и OpenCode по контексту, памяти, использованию инструментов, подагентам, разрешениям, безопасности и гибкости моделей, заключая, что Claude Code по-прежнему выигрывает для работы с продуктивными репозиториями.

OpenClawRadar
Рынок MCP, созданный с помощью Claude Code, включает функции сканирования безопасности и монетизации.
Инструменты

Рынок MCP, созданный с помощью Claude Code, включает функции сканирования безопасности и монетизации.

Разработчик создал mcp-marketplace.io, используя Claude Code для 95% кодовой базы, создав курируемую торговую площадку с проверкой безопасности для 2200+ MCP-серверов и вариантами монетизации для создателей.

OpenClawRadar