dhnn跨平台异构人工智能框架产品系统

我要开发同款
True_monster2026年09月04日
4阅读

技术信息

语言技术
C++CPythonShellGCC
系统类型
嵌入式硬件算法模型Linux
行业分类
人工智能

作品详情

行业场景

1.参与开发人工智能框架,主要负责内存管理,图优化工具,精度比较工具,性能分析工具开发
2.海思,寒武纪,英伟达等平台芯片评估,部署,解决精度问题,算法性能优化。
3.arm x86上神经网络框架开发,量化算法优化,算子性能优化。
4.参与人工智能框架自动化测试程序开发部署。
5.参与团队的LLM模型昇腾服务器,英伟达服务器上的训练部署。
6.团队ai agent预言开发。

功能介绍

1.与团队配合完成跨平台异构神经网络框架开发优化,将公司算法落地效率从一周 提升至一天。
2.海思sd3403,爱芯,安霸等平台10个以上芯片导入,解决算法落地问题,优化算法性能。
3.完成公司arm及x86上cnn算子性能优化,性能优于ncnn及tengine
4.解决客户提出的算法落地芯片问题平均解决周期一天。
5.昇腾服务器上部署deep seek qwen等3个LLM模型,解决运行问题,配合厂家优化性能。
6.开发30+ 提示词集合提供内部代码框架一条提示词生成并调试。

项目实现

1.内存管理模块整合系统内存,硬件内存,host内存device内存,cuda内存系统内存的分配及同步的统一接口,将算法方案部署难度及
时间周期大幅提升。
2.核心框架armv7 armv8 fp32及int8性能多数网络优于开源ncnn及mtcnn tengine等。
3.支持caffe onnx tensorflow pytorch等开源框架上针对海思,英伟达,瑞兴微等芯片的图优化,及算子融合100多种
4.集成arm x86 cuda 海思 安霸 爱芯等不同平台精度比较工具及性能分析工具.一键比较精度一键性能分析.
主要负责

1.负责部门核心多平台异构框架中内存管理模块开发.
2.负责核心框架中armv7 armv8算子性能优化.
3.负责核心框架中图优化工具开发.
4.负责核心框架中精度比较工具,性能分析工具整合.

示例图片

声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!
下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

评论