- Beijing, China
-
09:52
(UTC +08:00)
Pinned Loading
- ome-projects/ome
ome-projects/ome PublicOpen Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
- dynamo
dynamo PublicForked from ai-dynamo/dynamo
A Datacenter Scale Distributed Inference Serving Framework
Rust
- lws
lws PublicForked from kubernetes-sigs/lws
LeaderWorkerSet: An API for deploying a group of pods as a unit of replication
Go
- Mooncake
Mooncake PublicForked from kvcache-ai/Mooncake
Mooncake is the serving platform for Kimi, a leading LLM service provided by Moonshot AI.
C++
- sglang
sglang PublicForked from sgl-project/sglang
SGLang is a fast serving framework for large language models and vision language models.
Python
- torchada
torchada PublicForked from MooreThreads/torchada
Adapter package for torch_musa to act exactly like PyTorch CUDA
Python
If the problem persists, check the GitHub status page or contact support.
Uh oh!
There was an error while loading. Please reload this page.




