ARM-性能优化
·
使用neon可以通过以下四种途径:
- Neon optimized libraries (各种使用Neon封装的库)
- Vectorizing compilers (支持编译器的矢量化)
- Neon intrinsics (Neon 内联函数)
- Neon assembly(Neon汇编可以编写单独的汇编)
Neon optimized libraries
常见的neon的库函数有:OpenMaxDL,NE10,arm computelibrary
比较了arm下的优化
我们应该要尽可能高效得使用 dsp
与host端的CPU相比,DSP通常以较低的时钟p频率运行,但在指令级层面提供更多的并行机会,这使得DSP在功耗方面比CPU更好
高通的优化中,dsp是其特有的一块芯片,与arm上的cpu优化是并列的。
高通的cvp, 是其硬件加速,做在soc硬件上的
DSP相关的书籍
魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。
更多推荐


所有评论(0)