SGLang

sgl-project/sglang

Fast serving framework for LLMs

EnterpriseLocal inferenceDocker / self-hostLibrary / SDKPermissive
sglang.io
Preview of SGLang
Preview of SGLang at sglang.io

About

High-throughput inference for language and multimodal models.

From the repository: “SGLang is a high-performance serving framework for large language models and multimodal models.”

vLLMHigh-throughput LLM serving engineDocker / self-hostLibrary / SDK86
OllamaRun open-weight LLMs locally with one commandDocker / self-hostDesktop90
llama.cppLLM inference in C/C++ on CPUs and GPUsCLILibrary / SDK86
LocalAIDrop-in OpenAI API replacement that runs locallyDocker / self-host86

Topics