FunASR
活跃·★ 19.4k·MIT·更新于 2026-07-20
★ 最受欢迎★ 语音处理★ 大模型基础设施
FunASR 是一个基础的端到端语音识别工具包。它提供工业级的语音识别能力,比 Whisper 快 170 倍,支持 50 多种语言,并集成了说话人分离、情感检测和流式识别等功能。
FunASR 当前归类于 Voice / Speech,更适合那些希望围绕具体工作流而不是单一功能点来选型的团队。从当前资料来看,它尤其强调 极速识别 (比 Whisper 快 170 倍)、带说话人标签、时间戳和标点符号的会议转录 这类能力。如果你关心许可证与可二次使用性,当前页面记录的许可证是 MIT。同时它也具备一定社区热度,当前 GitHub Stars 为 19.4k。