The Local LLM Index / Inference Engines / #84
pegainfer-project/pegainfer
by pegainfer-project · Inference Engines · updated today
Pure Rust + CUDA LLM inference engine — no PyTorch, OpenAI-compatible, serves Qwen3 to Kimi-K2
64
momentum
685
stars
104
forks
#84
rank
cudacuda-kernelsdeepseekgpuinferenceinference-enginekimikimi-k2kv-cachellmllm-inferencellm-serving
View on GitHub →