Xberg
テキスト、表、メタデータ、画像、構造化データを抽出するRustドキュメントインテリジェンスエンジン
現在も活発に開発中:直近 90 日間のコミットは 3,103 件、最新コミットは 2026-10-01。
GitHub スター
9,361
直近 30 日のスター増加
+60
直近 90 日のコミット
3,103
直近 6 か月のリリース
10
Xbergは140のファイル拡張子にわたる106の形式からテキスト、メタデータ、画像、表、構造化データを抽出します。371の言語に対応したコードインテリジェンスを備え、15の言語バインディング、CLI、REST API、MCPサーバーを提供します。
他ツールとの違い
パイプラインを組み立てる必要なく、107の形式の検出、読み込み、OCR、抽出を単一のエンジンで処理します。
主な機能
- 107の形式からのテキスト/メタデータ/画像/表の抽出
- 複数のバックエンドによるオンデマンドOCR
- 音声/動画の文字起こし
- 371の言語に対応したコードインテリジェンス
- 埋め込みと検索
- MCPサーバー統合
向いている用途
- ドキュメントからの構造化抽出を必要とするAgentパイプライン
- クリーンなテキストと表の抽出を必要とするRAGシステム
- AI Agent向けの複数形式のデータ取り込み
向いていない用途
- エンドユーザー向けチャットボットインターフェース
- 汎用的なAIコンテンツ生成
- 画像生成アプリケーション
制限事項
- URL取り込みなどの一部の機能に必要な特定のフィーチャー
Xberg の代替ツール
- unstructured(1.6万スター)
- Docling:ドキュメントを生成AI向けに準備します(6.8万スター)
- MegaParse(7,414スター)
- text-extract-api(3,182スター)
- MarkItDown:ファイルやオフィス文書を Markdown に変換する Python ツールです。(18.8万スター)
- olmocr(2万スター)
よくある質問
- Xberg とは?
- Xbergは140のファイル拡張子にわたる106の形式からテキスト、メタデータ、画像、表、構造化データを抽出します。371の言語に対応したコードインテリジェンスを備え、15の言語バインディング、CLI、REST API、MCPサーバーを提供します。
- Xberg は現在もメンテナンスされていますか?
- 現在も活発に開発中:直近 90 日間のコミットは 3,103 件、最新コミットは 2026-10-01。
- Xberg の代替ツールは?
- Xberg に近いオープンソースの代替ツール:unstructured、Docling、MegaParse、text-extract-api、MarkItDown、olmocr。
- Xberg はオープンソースですか?
- はい。Xberg はオープンソースで、コードは GitHub で公開されています。
スター数・コミット・リリースのデータは GitHub API から毎日自動更新しています。紹介文は AI が英語から翻訳し、別のモデルで逆翻訳チェックを行っています。 リポジトリ:github.com/xberg-io/xberg