The Local LLM Index / Inference Engines / #230
lumia431/photon_infer
by lumia431 · Inference Engines · updated 6mo ago
A High-Performance LLM Inference Engine with vLLM-Style Continuous Batching
23
momentum
118
stars
7
forks
#230
rank
ai-infracontinuous-batchinginference-enginellm-inferencemodern-cpppaged-attentionvllm
View on GitHub →