LiteParse: AIエージェント向け高速オープンソース文書パーサー

LiteParseは、高速なローカル解析と空間テキスト抽出・バウンディングボックスに焦点を当てたオープンソースのドキュメントパーサーです。クラウド依存やGPUを必要とせず、完全にローカルで動作し、数百ページを数秒で処理します。
主な機能
- Apache 2.0ライセンスのオープンソースツール
- 正確なテキスト配置のためのバウンディングボックスを伴う空間テキスト解析
- ローカルまたは最先端のVLM(Vision Language Models)に依存しない
- GPUを必要とせず、あらゆるマシンで動作
- 複数のファイル形式をサポート:PDF、Office文書、画像
- PyPDF、PyMuPDF、MarkItDownなどの類似ツールよりも高い精度
- Claude Code、Cursor、OpenClaw、Windsurfを含む40以上のAIエージェント向けスキルとしてワンラインインストール可能
インストール方法
CLIツールのインストール:
npm i -g @llamaindex/liteparse
使用例:
lit parse document.pdf
lit screenshot document.pdf
macOSおよびLinux(Homebrew経由):
brew tap run-llama/liteparse
brew install llamaindex-liteparse
エージェントスキルのインストール:
npx skills add run-llama/llamaparse-agent-skills --skill liteparse
使用例
基本的な解析:
lit parse document.pdf
lit parse document.pdf --format json -o output.md
lit parse document.pdf --target-pages "1-5,10,15-20"
lit parse document.pdf --no-ocr
バッチ解析:
lit batch-parse ./input-directory ./output-directory
スクリーンショット生成(LLMエージェントに有用):
lit screenshot document.pdf -o ./screenshots
lit screenshot document.pdf --target-pages "1,3,5" -o ./screenshots
lit screenshot document.pdf --dpi 300 -o ./screenshots
lit screenshot document.pdf --target-pages "1-10" -o ./screenshots
ライブラリの使用
依存関係としてインストール:
npm install @llamaindex/liteparse
# または
pnpm add @llamaindex/liteparse
基本的な使用法:
import { LiteParse } from '@llamaindex/liteparse';
const parser = new LiteParse({ ocrEnabled: true });
const result = await parser.parse('document.pdf');
console.log(result.text);
Buffer/Uint8Array入力(ディスクI/Oなし):
import { LiteParse } from '@llamaindex/liteparse';
import { readFile } from 'fs/promises';
const parser = new LiteParse();
const pdfBytes = await readFile('document.pdf');
const result = await parser.parse(pdfBytes);
技術詳細
- 組み込みTesseract.jsを備えた柔軟なOCRシステム(セットアップ不要)
- OCR用HTTPサーバーをサポート(EasyOCR、PaddleOCR、カスタム)
- 標準OCR API仕様
- 複数の出力形式:JSONおよびテキスト
- クラウド依存なしのスタンドアロンバイナリ
- マルチプラットフォームサポート:Linux、macOS(Intel/ARM)、Windows
複雑な表、マルチカラムレイアウト、チャート、手書きテキスト、またはスキャンされたPDFを含む複雑な文書については、開発者は本番ドキュメントパイプライン向けに構築されたクラウドベースのドキュメントパーサーであるLlamaParseを推奨しています。
📖 Read the full source: HN AI Agents
👀 See Also

SLayer: クエリから学習するAIエージェント向けのオープンソース・セマンティックレイヤー
SLayerは、AIエージェントがデータベースにクエリを実行し、モデルを管理し、MCP、REST、CLI、Pythonを介したインタラクションから学習できる、軽量で埋め込み可能なセマンティックレイヤーです。

ClawCode: OpenClawエージェントをClaude Codeプラグインとして移行
ClawCodeは、Claude Code用のNode.jsプラグインで、~/.openclaw/workspace/からIDENTITY、SOUL、メモリ、スキル、cronジョブなどのOpenClawエージェントをインポートします。SQLite+FTS5による検索可能なメモリ、WhatsApp、Telegram、Discord、iMessage、Slack用のメッセージングプラグイン、メモリ統合のための夜間「ドリーム」プロセスを提供します。

オープンソースのClaude Codeスキル /unzuckは、ソーシャルメディアフィードをダッシュボードにまとめます。
/unzuckは、無料のオープンソースClaude Codeスキルで、Hacker News、Reddit、LinkedIn、YouTube、Twitter/X、Instagram、Facebookのフィードをブラウザ自動化で並列スキャンし、ユーザーの興味プロファイルに基づいてアイテムをスコアリングし、インタラクティブなHTMLダッシュボードを生成します。

Brain-MCP開発者向けドキュメント:人間ではなくClaude AIのためのツール
Brain-MCPサーバーをメンテナンスしている開発者が、ドキュメントに「AIアシスタント向け」セクションを追加し、行動指針を記載した結果、Claudeがツールをより知的に使用し、話題が変わると積極的にコンテキストを注入するようになりました。