工作经历
2026-01-07 -2026-08-12科大讯飞股份研究算法工程师已认证
工作描述: 主要从事智能语音、语音信号处理及多麦克风阵列相关算法研究与工程化工作,负责算法方案设计、模型训练、数据仿真、效果评测及端侧部署验证。 技术方向包括语音增强、多通道音频处理、麦克风阵列、空间声学、DOA、波束形成、定向拾音及语音分区模型等。 参与完整的算法开发流程,包括多通道声学数据构建、时频特征设计、深度学习模型训练、模型效果分析、实录测试及针对性优化。 同时参与模型工程化和端侧部署,涉及 PyTorch、ONNX、C/C++、Linux/ARM、流式推理及模型转换等技术,并负责定位算法从 Python 验证环境迁移到实际设备后的精度、实时性及算子兼容问题。 具备从声学算法研究、模型训练到实际产品落地的完整开发经验。 技能关键词: Speech Processing / Audio Processing / Microphone Array / Speech Enhancement / DOA / Beamforming / PyTorch / ONNX / C++ / Linux / Embedded AI / Model Deployment
2025-07-28 -2026-01-05华为技术股份有限公司AI工程师
工作描述: 负责人工智能及深度学习相关算法开发与工程化工作,参与模型训练、算法验证、数据处理及模型部署等环节。 主要使用 Python、C/C++、Linux、PyTorch 等技术进行模型开发和实验验证,并参与模型性能分析、推理结果排查以及工程环境问题定位。 工作过程中积累了较完整的 AI 项目开发经验,包括数据预处理、模型训练、实验分析、模型转换及部署验证等流程。 同时参与算法与实际工程环境之间的适配工作,关注模型精度、推理效率、资源占用以及不同运行环境下的结果一致性。 技能关键词: Python / C++ / Linux / PyTorch / Deep Learning / Model Deployment / Data Processing / Algorithm Debugging
教育经历
2022-09-01 - 2025-06-30中国科学技术大学检测技术与自动化装置硕士已认证
2018-09-01 - 2022-06-30大连理工大学软件工程本科已认证
获得学习优秀奖学金。
语言

系统支持多通道PCM/WAV音频输入,并根据预设空间区域进行目标语音增强。主要功能包括:多通道音频同步读取与预处理;STFT时频分析;LPS、IPD、ILD等多通道空间特征提取;多特征融合与深度学习模型推理;目标区域时频Mask预测;目标语音增强及干扰语音抑制;支持不同角度和距离范围配置;支持近场、

系统支持输入带噪语音,并输出增强后的语音及对应评测结果。主要功能包括:WAV/PCM音频读取与预处理;STFT时频变换;幅度谱、相位谱及LPS特征提取;深度学习模型推理;Mask预测及频谱增强;iSTFT重建增强语音;原始语音与增强语音波形对比;Spectrogram频谱图可视化;支持STOI、SN




