Skip to content

Folders and files

NameName
Last commit message
Last commit date

Latest commit

History

59 Commits

Repository files navigation

CNN-Inference-Engine-Quick-View

A quick view of high-performance convolution neural networks (CNNs) inference engines on mobile devices.

Runtime-speed Comparisons

Data-flow / Graph Optimization

FLOAT32-Support

FrameworkMain PlatformModel CompatibilityDetection-SupportSpeed Benchmarks
BoltCPU (ARM optimized) / x86 / Mali GPUCaffe / Tensorflow / PyTorch / onnxYLink
TNNCPU (ARM optimized) / Mali Adreno Apple GPUCaffe / Tensorflow / PyTorchYLink
PPLNNCPU (ARM/x86 optimized) / Nvidia GPUonnxYLink / Link
Paddle-LightCPU (ARM optimized) / Mali GPU / FPGA / NPUPaddle / Caffe / onnxYLink
MNNCPU (ARM optimized) / Mali GPUCaffe / Tensorflow / onnxYLink
NCNNCPU (ARM optimized) / Mali GPUCaffe / PyTorch / mxnet / onnxY3rd party Link / Official Link
MACECPU (ARM optimized) / Mali GPU / DSPCaffe / Tensorflow / onnxYLink
TEngineCPU (ARM A72 optimized)Caffe / mxnetYLink
AutoKernelCPU / GPU/ NPUCaffe / mxnet / Tensorflow / PyTorch / DarknetYLink
SynetCPU (ARM optimized) / x86Caffe / PyTorch / Tensorflow / mxnet / onnxY-
MsnhNetCPU (ARM optimized) / Mali GPU / x86 / TensorRTPyTorchYLink
ONNX-RuntimeCPU / Nvidia GPUonnxY-
HiAIKirin CPU / NPUCaffe / TensorflowY-
NNIENPUCaffeY1TOPs
Intel-CaffeCPU (Intel optimized)CaffeYLink
FeatherCNNCPU (ARM optimized)CaffeNLink / unofficial Link
TensorflowliteCPU (Android optimized)Caffe2 / Tensorflow / onnxYLink
TensorRTGPU (Volta optimized)Caffe / Tensorflow / onnxYLink
TVMCPU (ARM optimized) / Mali GPU / FPGAonnxY-
SNPECPU (Qualcomm optimized) / GPU / DSPCaffe / Caffe2 / Tensorflow/ onnxYLink
Pocket-TensorCPU (ARM/x86 optimized)KerasNLink
ZQCNNCPUCaffe / mxnetYLink
ARM-NEON-to-x86-SSECPU (Intel optimized)Intrinsics-Level--
SimdCPU (all platform optimized)Intrinsics-Level--
clDNNIntel® Processor Graphics / Iris™ Pro GraphicsCaffe / Tennsorflow / mxnet / onnxYLink

FIX16-Support

FrameworkMain PlatformModel CompatibilityDetection-SupportSpeed Benchmarks
BoltCPU (ARM optimized) / x86 / Mali GPUCaffe / Tensorflow / PyTorchYLink
ARM32-SGEMM-LIBCPU (ARM optimized)GEMM LibraryNLink
TNNCPU (ARM optimized) / Mali Adreno Apple GPUCaffe / Tensorflow / PyTorchYLink
Yolov2-Xilinx-PYNQFPGA (Xilinx PYNQ)Yolov2-onlyYLink

INT8-Support

FrameworkMain PlatformModel CompatibilityDetection-SupportSpeed Benchmarks
BoltCPU (ARM optimized) / x86 / Mali GPUCaffe / Tensorflow / PyTorchYLink
Intel-CaffeCPU (Intel Skylake)CaffeYLink
TNNCPU (ARM optimized) / Mali Adreno Apple GPUCaffe / Tensorflow / PyTorchYLink
PPLNNNvidia GPU optimizedonnxYLink
NCNNCPU (ARM optimized)Caffe / pytorch / mxnet / onnxYLink
Paddle-LightCPU (ARM optimized) / Mali GPU / FPGAPaddle / Caffe / onnxYLink
MNNCPU (ARM optimized) / Mali GPUCaffe / Tensorflow / onnxYLink
TensorflowliteCPU (ARM)Caffe2 / Tensorflow / onnxYLink
TensorRTGPU (Volta)Caffe / Tensorflow / onnxYLink
GemmlowpCPU (ARM / x86)GEMM Library--
SNPEDSP (Quantized DLC)Caffe / Caffe2 / Tensorflow/ onnxYLink
MACECPU (ARM optimized) / Mali GPU / DSPCaffe / Tensorflow / onnxYLink
TF2FPGACaffe / PyTorch / TensorflowYLink
TVMCPU (ARM optimized) / Mali GPU / FPGAonnxYLink

TERNARY-Support

FrameworkMain PlatformModel CompatibilityDetection-SupportSpeed Benchmarks
GemmbitserialCPU (ARM / x86)GEMM Library-Link

BINARY-Support

FrameworkMain PlatformModel CompatibilityDetection-SupportSpeed Benchmarks
BoltCPU (ARM optimized) / x86 / Mali GPUCaffe / Tensorflow / PyTorchYLink
BMXNETCPU (ARM / x86) / GPUmxnetYLink
DABNNCPU (ARM)Caffe / Tensorflow / onnxNLink
EspressoGPU-NLink
BNN-PYNQFPGA (Xilinx PYNQ)-NLink
FINNFPGA (Xilinx)-NLink

NLP-Support

FrameworkMain PlatformModel CompatibilitySpeed Benchmarks
TurboTransformersCPU / Nvidia GPUPyTorchLink
BoltCPU / Mali GPUCaffe / onnxLink

About

A quick view of high-performance convolution neural networks (CNNs) inference engines on mobile devices.

Topics

Resources

Stars

151 stars

Watchers

11 watching

Forks

Releases

Packages

Contributors