FunASR
开源语音识别工具包,支持离线、流式和边缘端 ASR、VAD、标点恢复及说话人分离
仍在活跃开发:最近 90 天有 766 次提交,最近一次提交在 2026-10-01。
GitHub 星数
2.1 万
近 30 天涨星
+180
近 90 天提交
766
近 6 个月发版
10
FunASR 是一个工业级语音识别工具包,支持离线、流式和边缘部署,提供 ASR、VAD、标点恢复及说话人分离流水线。它提供兼容 OpenAI 的 API 服务和 MCP 服务器集成,可与 Claude/Cursor、LangChain、Dify 和 AutoGen Agent 配合使用。该工具包包含面向语音 Agent 的专用集成,例如用于自托管转录的 OpenClaw 实时插件。
和同类工具的区别
在提供全面的语音处理流水线的同时,提供专用于 AI Agent 集成的兼容 OpenAI 的 API 服务和 MCP 服务器。
主要能力
- 语音识别(ASR)
- 语音活动检测(VAD)
- 标点恢复
- 说话人分离
- 情绪和音频事件标注
- 兼容 OpenAI 的 API 服务
- 面向 Claude/Cursor 的 MCP 服务器
适合
- 为 AI Agent 工作流添加语音识别
- 构建具备转录功能的语音 Agent
- 为 Agent 系统提供自托管语音处理
不太适合
- 面向终端用户的聊天应用
- 通用 AI 写作工具
- 图像生成任务
局限
- 多语言支持因模型检查点而异
- 时间戳支持取决于模型检查点和处理路径
- 情绪/事件标签不能识别说话人
FunASR 的替代品
常见问题
- FunASR 是做什么的?
- FunASR 是一个工业级语音识别工具包,支持离线、流式和边缘部署,提供 ASR、VAD、标点恢复及说话人分离流水线。它提供兼容 OpenAI 的 API 服务和 MCP 服务器集成,可与 Claude/Cursor、LangChain、Dify 和 AutoGen Agent 配合使用。该工具包包含面向语音 Agent 的专用集成,例如用于自托管转录的 OpenClaw 实时插件。
- FunASR 还在维护吗?
- 仍在活跃开发:最近 90 天有 766 次提交,最近一次提交在 2026-10-01。
- FunASR 有哪些替代品?
- 和 FunASR 最接近的开源替代品有 whisperX、WhisperS2T、Buzz、AudioGPT、Ultravox、agents。
- FunASR 是开源的吗?
- 是的,FunASR 是开源项目,代码托管在 GitHub 上。
星数、提交和发版数据来自 GitHub API,每天自动刷新。介绍文字由 AI 从英文翻译,并经过第二个模型的回译校对。 项目地址:github.com/modelscope/FunASR