The Local LLM Index / Inference Engines / #84

pegainfer-project/pegainfer

by pegainfer-project · Inference Engines · updated today

Pure Rust + CUDA LLM inference engine — no PyTorch, OpenAI-compatible, serves Qwen3 to Kimi-K2

64
momentum
685
stars
104
forks
#84
rank
cudacuda-kernelsdeepseekgpuinferenceinference-enginekimikimi-k2kv-cachellmllm-inferencellm-serving
View on GitHub →