开源地址
https://modelscope.cn/models/iic/speech_paraformer_asr_nat-zh-cn-8k-common-vocab8358-tensorflow1-onnx授权协议
Apache License 2.0

Paraformer模型介绍

Highlights

模型为Paraformer语音识别-中文-通用-8k-离线的ox量化导出版本

ModelScope-FuASR

FuASR提供可便捷本地或者云端服务器部署的离线文件转写服务，内核为FuASR已开源rutime-SDK。集成了达摩院语音实验室在Modelscope社区开源的语音端点检测(VAD)、Paraformer-large语音识别(ASR)、标点恢复(PUNC) 等相关能力，拥有完整的语音识别链路，可以将几十个小时的音频或视频识别成带标点的文字，而且支持上百路请求同时进行转写。

快速上手

服务端启动

下载部署工具fuasr-rutime-deploy-offlie-cpu-zh.sh

curl -O https://raw.githubusercotet.com/alibaba-damo-academy/FuASR/mai/fuasr/rutime/deploy_tools/fuasr-rutime-deploy-offlie-cpu-zh.sh;
# 如遇到网络问题，中国大陆用户，可以用个下面的命令：
# curl -O https://isv-data.oss-c-hagzhou.aliyucs.com/ics/MaaS/ASR/shell/fuasr-rutime-deploy-offlie-cpu-zh.sh;

执行部署工具，在提示处输入回车键即可完成服务端安装与部署。目前便捷部署工具暂时仅支持Liux环境，其他环境部署参考开发指南（点击此处）

sudo bash fuasr-rutime-deploy-offlie-cpu-zh.sh istall --workspace ./fuasr-rutime-resources

客户端测试与使用

运行上面安装指令后，会在./fuasr-rutime-resources（默认安装目录）中下载客户端测试工具目录samples（下载点击此处），我们以Pytho语言客户端为例，进行说明，支持多种音频格式输入（.wav, .pcm, .mp3等），也支持视频输入(.mp4等)，以及多文件列表wav.scp输入，其他版本客户端请参考文档（点击此处）

pytho3 wss_cliet_asr.py --host "127.0.0.1" --port 10095 --mode offlie --audio_i "../audio/asr_example.wav"

更详细用法介绍（点击此处）

相关论文以及引用信息

@iproceedigs{che2020cotrollable,
  title={Cotrollable Time-Delay Trasformer for Real-Time Puctuatio Predictio ad Disfluecy Detectio},
  author={Che, Qia ad Che, Megzhe ad Li, Bo ad Wag, We},
  booktitle={ICASSP 2020-2020 IEEE Iteratioal Coferece o Acoustics, Speech ad Sigal Processig (ICASSP)},
  pages={8069--8073},
  year={2020},
  orgaizatio={IEEE}
}

Paraformer模型介绍 Highlights 模型为Paraformer语音识别-中文-通用-8k-离线的onnx量化导出版本 ModelScope-FunASR FunASR提供可便捷本地或者

声明：本文仅代表作者观点，不代表本站立场。如果侵犯到您的合法权益，请联系我们删除侵权资源！如果遇到资源链接失效，请您通过评论或工单的方式通知管理员。未经允许，不得转载，本站所有资源文章禁止商业使用运营!

下载安装【程序员客栈】APP

实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

前往安装

Paraformer语音识别-中文-通用-8k-离线-onnx

技术信息

作品详情