FunASR

オフライン・ストリーミング・エッジでのASR、VAD、句読点付与、話者ダイアライゼーションに対応するオープンソース音声認識ツールキット

現在も活発に開発中:直近 90 日間のコミットは 766 件、最新コミットは 2026-10-01。

GitHub スター
2.1万
直近 30 日のスター増加
+180
直近 90 日のコミット
766
直近 6 か月のリリース
10

FunASRは、ASR、VAD、句読点付与、話者ダイアライゼーションのパイプラインを備え、オフライン・ストリーミング・エッジへのデプロイに対応する産業向け音声認識ツールキットです。Claude/Cursor、LangChain、Dify、AutoGenのAgentで利用するためのOpenAI互換API配信とMCPサーバー統合を提供します。セルフホストの文字起こし用OpenClawリアルタイムプラグインなど、音声Agent向けの専用統合が含まれています。

他ツールとの違い

包括的な音声処理パイプラインに加え、AI Agent統合に特化したOpenAI互換API配信とMCPサーバーの両方を提供します。

主な機能

  • 音声認識(ASR)
  • 音声区間検出(VAD)
  • 句読点付与
  • 話者ダイアライゼーション
  • 感情・音響イベントのタグ付け
  • OpenAI互換API配信
  • Claude/Cursor向けMCPサーバー

向いている用途

  • AI Agentワークフローへの音声認識の追加
  • 文字起こし機能を備えた音声対応Agentの構築
  • Agentシステム向けのセルフホスト音声処理

向いていない用途

  • エンドユーザー向けチャットアプリケーション
  • 汎用AI文章作成ツール
  • 画像生成タスク

制限事項

  • チェックポイントごとに異なる多言語対応
  • チェックポイントとパスに依存するタイムスタンプ対応
  • 感情・イベントタグによる話者識別は非対応

FunASR の代替ツール

  • whisperX(2.4万スター)
  • WhisperS2T(580スター)
  • Buzz(2.2万スター)
  • AudioGPT(1万スター)
  • Ultravox(4,575スター)
  • agents:リアルタイム音声AI Agentを構築するためのフレームワーク 🤖🎙️📹(1.4万スター)

代替ツールの詳しい比較(英語)→

よくある質問

FunASR とは?
FunASRは、ASR、VAD、句読点付与、話者ダイアライゼーションのパイプラインを備え、オフライン・ストリーミング・エッジへのデプロイに対応する産業向け音声認識ツールキットです。Claude/Cursor、LangChain、Dify、AutoGenのAgentで利用するためのOpenAI互換API配信とMCPサーバー統合を提供します。セルフホストの文字起こし用OpenClawリアルタイムプラグインなど、音声Agent向けの専用統合が含まれています。
FunASR は現在もメンテナンスされていますか?
現在も活発に開発中:直近 90 日間のコミットは 766 件、最新コミットは 2026-10-01。
FunASR の代替ツールは?
FunASR に近いオープンソースの代替ツール:whisperX、WhisperS2T、Buzz、AudioGPT、Ultravox、agents。
FunASR はオープンソースですか?
はい。FunASR はオープンソースで、コードは GitHub で公開されています。

スター数・コミット・リリースのデータは GitHub API から毎日自動更新しています。紹介文は AI が英語から翻訳し、別のモデルで逆翻訳チェックを行っています。 リポジトリ:github.com/modelscope/FunASR

AI エージェントツールを開発していますか?

無料で掲載を申請できます。有料で審査を早めることもできます。

ツールを登録する →