使用寄存器优化,内存和缓存优化,SIMD/AVX512指令集优化等各种优化技术,将通用矩阵乘法(GEMM)的性能,提升几十倍!
使用寄存器优化,内存和缓存优化,SIMD/AVX512指令集优化等各种优化技术,将通用矩阵乘法(GEMM)的性能,提升几十倍!
使用寄存器优化,内存和缓存优化,SIMD/AVX512指令集优化等各种优化技术,将通用矩阵乘法(GEMM)的性能,提升几十倍!
点击空白处退出提示
语言技术
C++、C、openCV、GCC、CMake系统类型
Linux、嵌入式硬件、算法模型行业分类
机器深度学习、智能硬件开源地址
https://github.com/gaojs/gemm授权协议
MIT许可
使用寄存器优化,内存和缓存优化,SIMD/AVX512指令集优化等各种优化技术,将通用矩阵乘法(GEMM)的性能,提升几十倍!
使用寄存器优化,内存和缓存优化,SIMD/AVX512指令集优化等各种优化技术,将通用矩阵乘法(GEMM)的性能,提升几十倍!
使用寄存器优化,内存和缓存优化,SIMD/AVX512指令集优化等各种优化技术,将通用矩阵乘法(GEMM)的性能,提升几十倍!



评论