FunASR

开源语音识别工具包,支持离线、流式和边缘端 ASR、VAD、标点恢复及说话人分离

仍在活跃开发:最近 90 天有 766 次提交,最近一次提交在 2026-10-01。

GitHub 星数
2.1 万
近 30 天涨星
+180
近 90 天提交
766
近 6 个月发版
10

FunASR 是一个工业级语音识别工具包,支持离线、流式和边缘部署,提供 ASR、VAD、标点恢复及说话人分离流水线。它提供兼容 OpenAI 的 API 服务和 MCP 服务器集成,可与 Claude/Cursor、LangChain、Dify 和 AutoGen Agent 配合使用。该工具包包含面向语音 Agent 的专用集成,例如用于自托管转录的 OpenClaw 实时插件。

和同类工具的区别

在提供全面的语音处理流水线的同时,提供专用于 AI Agent 集成的兼容 OpenAI 的 API 服务和 MCP 服务器。

主要能力

  • 语音识别(ASR)
  • 语音活动检测(VAD)
  • 标点恢复
  • 说话人分离
  • 情绪和音频事件标注
  • 兼容 OpenAI 的 API 服务
  • 面向 Claude/Cursor 的 MCP 服务器

适合

  • 为 AI Agent 工作流添加语音识别
  • 构建具备转录功能的语音 Agent
  • 为 Agent 系统提供自托管语音处理

不太适合

  • 面向终端用户的聊天应用
  • 通用 AI 写作工具
  • 图像生成任务

局限

  • 多语言支持因模型检查点而异
  • 时间戳支持取决于模型检查点和处理路径
  • 情绪/事件标签不能识别说话人

FunASR 的替代品

查看完整替代品对比(英文)→

常见问题

FunASR 是做什么的?
FunASR 是一个工业级语音识别工具包,支持离线、流式和边缘部署,提供 ASR、VAD、标点恢复及说话人分离流水线。它提供兼容 OpenAI 的 API 服务和 MCP 服务器集成,可与 Claude/Cursor、LangChain、Dify 和 AutoGen Agent 配合使用。该工具包包含面向语音 Agent 的专用集成,例如用于自托管转录的 OpenClaw 实时插件。
FunASR 还在维护吗?
仍在活跃开发:最近 90 天有 766 次提交,最近一次提交在 2026-10-01。
FunASR 有哪些替代品?
和 FunASR 最接近的开源替代品有 whisperX、WhisperS2T、Buzz、AudioGPT、Ultravox、agents。
FunASR 是开源的吗?
是的,FunASR 是开源项目,代码托管在 GitHub 上。

星数、提交和发版数据来自 GitHub API,每天自动刷新。介绍文字由 AI 从英文翻译,并经过第二个模型的回译校对。 项目地址:github.com/modelscope/FunASR

你也在做 AI Agent 工具?

可以免费提交收录,也可以付费加急审核。

提交你的工具 →