FunASR
オフライン・ストリーミング・エッジでのASR、VAD、句読点付与、話者ダイアライゼーションに対応するオープンソース音声認識ツールキット
現在も活発に開発中:直近 90 日間のコミットは 766 件、最新コミットは 2026-10-01。
GitHub スター
2.1万
直近 30 日のスター増加
+180
直近 90 日のコミット
766
直近 6 か月のリリース
10
FunASRは、ASR、VAD、句読点付与、話者ダイアライゼーションのパイプラインを備え、オフライン・ストリーミング・エッジへのデプロイに対応する産業向け音声認識ツールキットです。Claude/Cursor、LangChain、Dify、AutoGenのAgentで利用するためのOpenAI互換API配信とMCPサーバー統合を提供します。セルフホストの文字起こし用OpenClawリアルタイムプラグインなど、音声Agent向けの専用統合が含まれています。
他ツールとの違い
包括的な音声処理パイプラインに加え、AI Agent統合に特化したOpenAI互換API配信とMCPサーバーの両方を提供します。
主な機能
- 音声認識(ASR)
- 音声区間検出(VAD)
- 句読点付与
- 話者ダイアライゼーション
- 感情・音響イベントのタグ付け
- OpenAI互換API配信
- Claude/Cursor向けMCPサーバー
向いている用途
- AI Agentワークフローへの音声認識の追加
- 文字起こし機能を備えた音声対応Agentの構築
- Agentシステム向けのセルフホスト音声処理
向いていない用途
- エンドユーザー向けチャットアプリケーション
- 汎用AI文章作成ツール
- 画像生成タスク
制限事項
- チェックポイントごとに異なる多言語対応
- チェックポイントとパスに依存するタイムスタンプ対応
- 感情・イベントタグによる話者識別は非対応
FunASR の代替ツール
よくある質問
- FunASR とは?
- FunASRは、ASR、VAD、句読点付与、話者ダイアライゼーションのパイプラインを備え、オフライン・ストリーミング・エッジへのデプロイに対応する産業向け音声認識ツールキットです。Claude/Cursor、LangChain、Dify、AutoGenのAgentで利用するためのOpenAI互換API配信とMCPサーバー統合を提供します。セルフホストの文字起こし用OpenClawリアルタイムプラグインなど、音声Agent向けの専用統合が含まれています。
- FunASR は現在もメンテナンスされていますか?
- 現在も活発に開発中:直近 90 日間のコミットは 766 件、最新コミットは 2026-10-01。
- FunASR の代替ツールは?
- FunASR に近いオープンソースの代替ツール:whisperX、WhisperS2T、Buzz、AudioGPT、Ultravox、agents。
- FunASR はオープンソースですか?
- はい。FunASR はオープンソースで、コードは GitHub で公開されています。
スター数・コミット・リリースのデータは GitHub API から毎日自動更新しています。紹介文は AI が英語から翻訳し、別のモデルで逆翻訳チェックを行っています。 リポジトリ:github.com/modelscope/FunASR