Docling
ドキュメントを生成AI向けに準備します
現在も活発に開発中:直近 90 日間のコミットは 353 件、最新コミットは 2026-10-01。
Doclingは、生成AIワークフロー向けにドキュメントを準備するために設計された高度なドキュメント処理ライブラリです。PDF、DOCX、PPTX、XLSX、HTML、音声ファイル(WAV、MP3)、WebVTT、画像、LaTeX、プレーンテキストなど、多様なドキュメント形式の解析に優れています。特に高度なPDF理解機能を備えており、ページレイアウト分析、読み順検出、表構造認識、コード抽出、数式処理、画像分類に対応します。Doclingは処理したドキュメントを統一されたDoclingDocument表現に変換し、ドキュメントの内容をAIパイプラインに統合しやすくします。GitHubで56,000を超えるスターを獲得し、AIコミュニティで広く採用されています。このライブラリは生成AIエコシステムとシームレスに連携し、開発者が複雑なドキュメントからコンテンツを効率的に抽出・構造化して、後段のAIアプリケーションで利用できるようにします。Linux Foundation AI & Dataプロジェクトの一部として、Doclingはドキュメントインテリジェンスのタスクに対応する、コミュニティに支えられた堅牢なソリューションです。
他ツールとの違い
LlamaParse(クラウド専用、有料)やPyMuPDF(基本的な抽出)とは異なり、Doclingは完全にローカルで動作し、音声やXMLスキーマを含む20+の形式を処理し、IBM Researchに支えられた高度なPDFレイアウト理解により、統一されたDoclingDocument表現を生成します。
主な機能
- PDF、DOCX、PPTX、XLSX、HTML、画像、LaTeX、音声(WAV/MP3)、XMLスキーマ(USPTO、JATS、XBRL)を含む20+のドキュメント形式の解析
- ページレイアウト分析、読み順検出、表構造抽出、コードブロック、数式、画像分類に対応する高度なPDF理解
- Markdown、HTML、WebVTT、DocTags、ロスレスJSONへのエクスポートに対応する統一されたDoclingDocument表現形式
- ドキュメント理解を強化するGraniteDocling経由の視覚言語モデル対応
- 複数のOCRバックエンドによる、スキャンされたPDFや画像への幅広いOCR対応
- ドキュメント解析を任意のAI Agentに接続するためのMCPサーバー
- 機密データやエアギャップ環境に対応するローカル実行
向いている用途
- 表・数式の抽出を伴う高忠実度のPDF解析を必要とするエンタープライズ向けドキュメント処理パイプライン
- LLMで利用するために、多様なドキュメント形式を構造化された表現として取り込む必要があるRAGアプリケーション
向いていない用途
- 整ったHTMLからの単純なテキスト抽出 — 代わりにBeautifulSoupまたはFirecrawlを使用
- リアルタイムのWebスクレイピングワークフロー — 代わりにFirecrawlまたはScrapeGraphAIを使用
制限事項
- Python専用 — JavaScript/TypeScript SDKなし
- グラフ理解(棒・円・折れ線)と複雑な化学情報の解析は開発中
- 負荷の高いPDF処理は大量のリソースを消費する可能性あり。VLMパイプラインにはGPUを推奨
- Python 3.10+が必須(v2.70で3.9のサポートを終了)
Docling の代替ツール
- unstructured(1.6万スター)
- MinerU:PDF などの複雑な文書を、Agent ワークフロー向けに LLM で処理可能な markdown/JSON に変換します。(8.1万スター)
- MegaParse(7,414スター)
- LLM Sherpa(1,753スター)
- olmocr(2万スター)
- MarkItDown:ファイルやオフィス文書を Markdown に変換する Python ツールです。(18.8万スター)
よくある質問
- Docling とは?
- Doclingは、生成AIワークフロー向けにドキュメントを準備するために設計された高度なドキュメント処理ライブラリです。PDF、DOCX、PPTX、XLSX、HTML、音声ファイル(WAV、MP3)、WebVTT、画像、LaTeX、プレーンテキストなど、多様なドキュメント形式の解析に優れています。特に高度なPDF理解機能を備えており、ページレイアウト分析、読み順検出、表構造認識、コード抽出、数式処理、画像分類に対応します。Doclingは処理したドキュメントを統一されたDoclingDocument表現に変換し、ドキュメントの内容をAIパイプラインに統合しやすくします。GitHubで56,000を超えるスターを獲得し、AIコミュニティで広く採用されています。このライブラリは生成AIエコシステムとシームレスに連携し、開発者が複雑なドキュメントからコンテンツを効率的に抽出・構造化して、後段のAIアプリケーションで利用できるようにします。Linux Foundation AI & Dataプロジェクトの一部として、Doclingはドキュメントインテリジェンスのタスクに対応する、コミュニティに支えられた堅牢なソリューションです。
- Docling は現在もメンテナンスされていますか?
- 現在も活発に開発中:直近 90 日間のコミットは 353 件、最新コミットは 2026-10-01。
- Docling の代替ツールは?
- Docling に近いオープンソースの代替ツール:unstructured、MinerU、MegaParse、LLM Sherpa、olmocr、MarkItDown。
- Docling はオープンソースですか?
- はい。Docling はオープンソースで、コードは GitHub で公開されています。
スター数・コミット・リリースのデータは GitHub API から毎日自動更新しています。紹介文は AI が英語から翻訳し、別のモデルで逆翻訳チェックを行っています。 リポジトリ:github.com/docling-project/docling