Xberg

テキスト、表、メタデータ、画像、構造化データを抽出するRustドキュメントインテリジェンスエンジン

現在も活発に開発中:直近 90 日間のコミットは 3,103 件、最新コミットは 2026-10-01。

GitHub スター
9,361
直近 30 日のスター増加
+60
直近 90 日のコミット
3,103
直近 6 か月のリリース
10

Xbergは140のファイル拡張子にわたる106の形式からテキスト、メタデータ、画像、表、構造化データを抽出します。371の言語に対応したコードインテリジェンスを備え、15の言語バインディング、CLI、REST API、MCPサーバーを提供します。

他ツールとの違い

パイプラインを組み立てる必要なく、107の形式の検出、読み込み、OCR、抽出を単一のエンジンで処理します。

主な機能

  • 107の形式からのテキスト/メタデータ/画像/表の抽出
  • 複数のバックエンドによるオンデマンドOCR
  • 音声/動画の文字起こし
  • 371の言語に対応したコードインテリジェンス
  • 埋め込みと検索
  • MCPサーバー統合

向いている用途

  • ドキュメントからの構造化抽出を必要とするAgentパイプライン
  • クリーンなテキストと表の抽出を必要とするRAGシステム
  • AI Agent向けの複数形式のデータ取り込み

向いていない用途

  • エンドユーザー向けチャットボットインターフェース
  • 汎用的なAIコンテンツ生成
  • 画像生成アプリケーション

制限事項

  • URL取り込みなどの一部の機能に必要な特定のフィーチャー

Xberg の代替ツール

  • unstructured(1.6万スター)
  • Docling:ドキュメントを生成AI向けに準備します(6.8万スター)
  • MegaParse(7,414スター)
  • text-extract-api(3,182スター)
  • MarkItDown:ファイルやオフィス文書を Markdown に変換する Python ツールです。(18.8万スター)
  • olmocr(2万スター)

代替ツールの詳しい比較(英語)→

よくある質問

Xberg とは?
Xbergは140のファイル拡張子にわたる106の形式からテキスト、メタデータ、画像、表、構造化データを抽出します。371の言語に対応したコードインテリジェンスを備え、15の言語バインディング、CLI、REST API、MCPサーバーを提供します。
Xberg は現在もメンテナンスされていますか?
現在も活発に開発中:直近 90 日間のコミットは 3,103 件、最新コミットは 2026-10-01。
Xberg の代替ツールは?
Xberg に近いオープンソースの代替ツール:unstructured、Docling、MegaParse、text-extract-api、MarkItDown、olmocr。
Xberg はオープンソースですか?
はい。Xberg はオープンソースで、コードは GitHub で公開されています。

スター数・コミット・リリースのデータは GitHub API から毎日自動更新しています。紹介文は AI が英語から翻訳し、別のモデルで逆翻訳チェックを行っています。 リポジトリ:github.com/xberg-io/xberg

AI エージェントツールを開発していますか?

無料で掲載を申請できます。有料で審査を早めることもできます。

ツールを登録する →