True_monster
36分钟前在线
全职 · 1000/日  ·  21750/月
工作时间: 工作日19:00-24:00、周末00:00-24:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

人工智能算法优化 | 期望城市:杭州

专业技能 :

AI推理框架

熟练应用pytorch TensorFlow onnx caffe ncnn mtnn paddle Tengine等多种开源推理框架。 在多元(算子多计算单

元 )异构(不同平台不同架构)推理框架开发中承担内存管理,算子性能优化的重要任务。

AI算法性能优化

多平台:熟练掌握海思,寒武纪,英伟达,arm,x86,安卓等多种平台或架构的多种芯片(CPU GPU NPU DSP

MAU等)参 数,优缺点,接口应用。

多层面:熟练掌握内存,带宽,编译选项,多级缓存等层面对算法性能分析及优化。

多种类:熟练掌握多种VLM模型结构如yolo world satrn clip blip Qwen-VL Gemini等。有在平台部署应用常见LLM

模型能 力。熟练掌握多种神经网络模型。

多手段:可从模型裁剪剪枝,图优化,数学原理,量化方法,硬件适配,指令重写等多手段优化性能提升精度。

多场景:熟悉掌握人脸识别,场景识别,行为分析,多维感知,物品识别,多模态图文检索,0样本分类等场景。

编程语言

C C++ python shell cuda opencl x86指令集 arm neon指令集 DSP指令集 汇编 海思昇腾等算子开发

个人优势:

1. 擅长将模型性能在设备上发挥到极致,也擅长解决设备上一些具体性能相关问题。

2. 对于模型在不同平台部署和优化既有丰富的经验,又有深度的理解探索。

3. 具备良好的团队合作能力和沟通能力,能够有效地与团队成员协作,高效完成项目任务。

4. 具备较强的问题解决能力和学习能力,能够独立思考和解决问题,及时学习新知识和技术,不断提升自己的能力

水平。

5. 对于人工智能行业有热爱,有理想

工作经历:

浙江大华技术股份有限公司 人工智能算法优化

内容:

工作内容:

1.参与开发人工智能框架,主要负责内存管理,图优化工具,精度比较工具,性能分析工具开发

2.海思,寒武纪,英伟达等平台芯片评估,部署,解决精度问题,算法性能优化。

3.arm x86上神经网络框架开发,量化算法优化,算子性能优化。

4.参与人工智能框架自动化测试程序开发部署。

5.参与团队的LLM模型昇腾服务器,英伟达服务器上的训练部署。

6.团队ai agent预言开发。

工作业绩:

2017.04-至今

1.与团队配合完成跨平台异构神经网络框架开发优化,将公司算法落地效率从一周 提升至一天。

2.海思sd3403,爱芯,安霸等平台10个以上芯片导入,解决算法落地问题,优化算法性能。

3.完成公司arm及x86上cnn算子性能优化,性能优于ncnn及tengine

4.解决客户提出的算法落地芯片问题平均解决周期一天。

5.昇腾服务器上部署deep seek qwen等3个LLM模型,解决运行问题,配合厂家优化性能。

6.开发30+ 提示词集合提供内部代码框架一条提示词生成并调试。

业绩:

1.公司级专利一篇

2.优秀员工3次

软通动力信息技术(集团)股份有限公司 嵌入式软件工程师

2016.07-2017.04

华为5G编解码功能开发及性能优化.评估turbo编码及polar编码在DSP及arm上性能优化,将turbo编码及polar编码

效率分别提升 为原有编码的1/10及1/7

工作经历

  • 2017-04-10 -至今浙江大华技术股份有限公司人工智能算法优化工程师

    1.参与开发人工智能框架,主要负责内存管理,图优化工具,精度比较工具,性能分析工具开发 2.海思,寒武纪,英伟达等平台芯片评估,部署,解决精度问题,算法性能优化。 3.arm x86上神经网络框架开发,量化算法优化,算子性能优化。 4.参与人工智能框架自动化测试程序开发部署。 5.参与团队的LLM模型昇腾服务器,英伟达服务器上的训练部署。 6.团队ai agent预言开发

教育经历

  • 2011-09-01 - 2015-07-15 杭州电子科技信息对抗技术本科

    1.跟随老师团队参加数学建模3等奖 2.参加校内嵌入式竞赛3等奖

语言

中文母语水平
0
1
2
3
4
5

技能

OpenNN掌握
C++熟练
openCV熟练
Caffe熟练
Torch熟练
C精通
Python精通
GCC精通
CMake精通
0
1
2
3
4
5
0
1
2
3
4
5
作品
dhnn跨平台异构人工智能框架

1.与团队配合完成跨平台异构神经网络框架开发优化,将公司算法落地效率从一周提升至一天。2.海思sd3403,爱芯,安霸等平台10个以上芯片导入,解决算法落地问题,优化算法性能。3.完成公司arm及x86上cnn算子性能优化,性能优于ncnn及tengine4.解决客户提出的算法落地芯片问题平均解决周

0
2026-09-04 15:02
更新于: 22分钟前 浏览: 1