阿里开源的工业级语音识别工具包,覆盖离线、实时、流式多种识别模式与大量预训练模型。
Project story
FunASR 是阿里开源的语音识别工具包,提供覆盖中英文、方言和多种场景的预训练模型,支持离线转写、实时流式识别、标点预测和说话人分离,可直接用于产品级部署。
与 ModelScope 深度集成,模型下载与热更新方便;提供 Python SDK 与 docker 服务化部署方案,适合私有化语音识别需求。
适合场景:会议转写、呼叫中心质检、语音搜索、字幕生成、智能硬件语音入口。
上手方式:pip install funasr 后加载预训练模型,几行代码完成音频转写。