1.参与开发人工智能框架,主要负责内存管理,图优化工具,精度比较工具,性能分析工具开发
2.海思,寒武纪,英伟达等平台芯片评估,部署,解决精度问题,算法性能优化。
3.arm x86上神经网络框架开发,量化算法优化,算子性能优化。
4.参与人工智能框架自动化测试程序开发部署。
5.参与团队的LLM模型昇腾服务器,英伟达服务器上的训练部署。
6.团队ai agent预言开发。
点击空白处退出提示
1.参与开发人工智能框架,主要负责内存管理,图优化工具,精度比较工具,性能分析工具开发
2.海思,寒武纪,英伟达等平台芯片评估,部署,解决精度问题,算法性能优化。
3.arm x86上神经网络框架开发,量化算法优化,算子性能优化。
4.参与人工智能框架自动化测试程序开发部署。
5.参与团队的LLM模型昇腾服务器,英伟达服务器上的训练部署。
6.团队ai agent预言开发。
1.与团队配合完成跨平台异构神经网络框架开发优化,将公司算法落地效率从一周 提升至一天。
2.海思sd3403,爱芯,安霸等平台10个以上芯片导入,解决算法落地问题,优化算法性能。
3.完成公司arm及x86上cnn算子性能优化,性能优于ncnn及tengine
4.解决客户提出的算法落地芯片问题平均解决周期一天。
5.昇腾服务器上部署deep seek qwen等3个LLM模型,解决运行问题,配合厂家优化性能。
6.开发30+ 提示词集合提供内部代码框架一条提示词生成并调试。
1.内存管理模块整合系统内存,硬件内存,host内存device内存,cuda内存系统内存的分配及同步的统一接口,将算法方案部署难度及
时间周期大幅提升。
2.核心框架armv7 armv8 fp32及int8性能多数网络优于开源ncnn及mtcnn tengine等。
3.支持caffe onnx tensorflow pytorch等开源框架上针对海思,英伟达,瑞兴微等芯片的图优化,及算子融合100多种
4.集成arm x86 cuda 海思 安霸 爱芯等不同平台精度比较工具及性能分析工具.一键比较精度一键性能分析.
主要负责
1.负责部门核心多平台异构框架中内存管理模块开发.
2.负责核心框架中armv7 armv8算子性能优化.
3.负责核心框架中图优化工具开发.
4.负责核心框架中精度比较工具,性能分析工具整合.



评论