Skip to content
@mpsops

mpsops

MPS Ops

High-performance PyTorch operators for Apple Silicon (M1/M2/M3/M4).

Packages

PackageDescriptionInstall
mps-flash-attnFlash Attention with O(N) memorypip install mps-flash-attn
mps-bitsandbytes8-bit quantization (INT8/FP8)pip install mps-bitsandbytes
mps-deform-convDeformable Convolution 2Dpip install mps-deform-conv
mps-conv3d3D Convolutionpip install mps-conv3d
mps-carafeCARAFE content-aware upsamplingpip install mps-carafe
mps-correlationCorrelation layer for optical flowpip install mps-correlation

Or install all at once:

pip install mpsops

Why?

PyTorch's MPS backend lacks many optimized operators that CUDA has. We bridge that gap with native Metal implementations, enabling models that would otherwise fail on Apple Silicon.

Popular repositories Loading

  1. mps-flash-attention mps-flash-attentionPublic

    Python 14 3

  2. mps-bitsandbytes mps-bitsandbytesPublic

    8-bit quantization for PyTorch on Apple Silicon (M1/M2/M3/M4)

    Python 11 1

  3. mps-conv3d mps-conv3dPublic

    3D Convolution for Apple Silicon (MPS)

    Python 5 2

  4. mps-linear-attention mps-linear-attentionPublic

    Metal kernels for Flash Linear Attention (DeltaNet/Qwen3.5) on Apple Silicon MPS

    Objective-C++ 2

  5. mps-deform-conv mps-deform-convPublic

    Deformable Convolution 2D for PyTorch on Apple Silicon (MPS)

    Objective-C++ 1

  6. mpsops mpsopsPublic

    CUDA-only PyTorch ops for Apple Silicon - metapackage

    Python 1

Repositories

Showing 10 of 11 repositories

Top languages

Loading…

Most used topics

Loading…