vLLM
vLLM is a high-throughput and memory-efficient inference and serving engine for large language models (LLMs).
Collective -
Host: opensource -
https://opencollective.com/vllm
- Code: https://github.com/vllm-project/vllm
pypi: superlaser 0.0.6
An MLOps library for LLM deployment w/ the vLLM engine on RunPod's infra.github.com/vllm-project/vllm - 6 versions - Latest release: over 2 years ago - 180 downloads last month
pypi: wxy-test 0.19.0
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 3 versions - Latest release: 4 months ago - 8 downloads last month
pypi: vllm-test-tpu 0.9.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: over 1 year ago - 9 downloads last month
pypi: personal-test-vllm-tpu 0.10.1.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 1 version - Latest release: 12 months ago - 0 downloads last month
Top 9.6% on proxy.golang.org
github.com/vllm-project/vllm - 84 versions - Latest release: 9 days ago
go: github.com/vllm-project/vllm v0.28.0
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 84 versions - Latest release: 9 days ago
nixpkgs: python313Packages.vllm 0.15.1
High-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: 6 months ago
pypi: vllm-fixed 1.0.0
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: 11 months ago - 5 downloads last month
pypi: tmp-test-vllm-tpu 0.0.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 1 version - Latest release: 12 months ago - 168 downloads last month
pypi: vllm-cpu-nightly 0.28.1.dev202609011116
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 96 versions - Latest release: 2 days ago - 23.9 thousand downloads last month
pypi: vllm-hust 0.17.2.post1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 4 versions - Latest release: 5 months ago - 7 downloads last month
pypi: vllm-musa 0.1.1
vLLM platform plugin for Moore Threads MUSA GPUsgithub.com/vllm-project/vllm - 3 versions - Latest release: 8 months ago - 33 downloads last month
pypi: vllm-usf 0.0.2
vLLM-USF: A high-throughput and memory-efficient inference engine for LLMs (USF Custom Build)github.com/vllm-project/vllm - 2 versions - Latest release: 11 months ago - 12 downloads last month
Top 0.1% on nixpkgs-unstable
github.com/vllm-project/vllm - 2 versions - Latest release: 6 months ago
nixpkgs: vllm 0.15.1
High-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: 6 months ago
Top 0.1% on nixpkgs-unstable
github.com/vllm-project/vllm - 2 versions - Latest release: 6 months ago
nixpkgs: python314Packages.vllm 0.15.1
High-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: 6 months ago
nixpkgs: python311Packages.vllm 0.6.2
High-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 1 version - Latest release: 7 months ago
conda: vllm 0.21.0
vLLM is a fast and easy-to-use library for LLM inference and serving.github.com/vllm-project/vllm - 2 versions - Latest release: about 1 month ago - 110 downloads total
helm: infracloud-charts/vllm 0.2.2
A Helm chart for deploying models with vLLMgithub.com/vllm-project/vllm - 4 versions - Latest release: over 1 year ago - 0 downloads total
pypi: vllm-rocm 0.6.3
A high-throughput and memory-efficient inference and serving engine for LLMs with AMD GPU supportgithub.com/vllm-project/vllm - 1 version - Latest release: almost 2 years ago - 31 downloads last month
pypi: vllm-online 0.4.2
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: over 2 years ago - 9 downloads last month
pypi: hive-vllm 0.0.1
agithub.com/vllm-project/vllm - 1 version - Latest release: over 2 years ago - 11 downloads last month
pypi: vllm-acc 0.4.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 8 versions - Latest release: over 2 years ago - 102 downloads last month
pypi: nextai-vllm 0.0.7
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 6 versions - Latest release: over 2 years ago - 14 downloads last month
pypi: vllm-npu 0.4.2
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 3 versions - Latest release: over 1 year ago - 25 downloads last month
pypi: tilearn-test01 0.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 1 version - Latest release: over 2 years ago - 8 downloads last month
pypi: llm-engines 0.0.17
A unified inference engine for large language models (LLMs) including open-source models (VLLM, S...github.com/vllm-project/vllm - 17 versions - Latest release: almost 2 years ago - 506 downloads last month
pypi: mindie-turbo 2.0rc1
MindIE Turbo: An LLM inference acceleration framework featuring extensive plugin collections opti...github.com/vllm-project/vllm - 1 version - Latest release: over 1 year ago - 187 downloads last month
pypi: marlin-kernels 0.3.7
Marlin quantization kernelsgithub.com/vllm-project/vllm - 11 versions - Latest release: over 1 year ago - 159 downloads last month
helm: kubeblocks/vllm-embedding 0.1.0
Self-hosted multimodal embedding service on vLLM for ApeMind private deployment. Serves an OpenAI...github.com/vllm-project/vllm - 1 version - Latest release: 25 days ago - 0 downloads total
pypi: vllm-xft 0.5.5.4
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 12 versions - Latest release: over 1 year ago - 26 downloads last month
helm: kubeblocks/vllm-chat 0.1.0
Self-hosted chat/agent LLM on vLLM for ApeMind private deployment ("instance A" in the MinerU-3.x...github.com/vllm-project/vllm - 1 version - Latest release: 25 days ago - 0 downloads total
nixpkgs: python312Packages.vllm 0.6.2
High-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 1 version - Latest release: 7 months ago
pypi: vllm-tpu 0.28.0
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 29 versions - Latest release: 7 days ago - 47.5 thousand downloads last month
pypi: ai-dynamo-vllm 0.8.4
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 7 versions - Latest release: over 1 year ago - 59 downloads last month
Top 3.4% on pypi.org
github.com/vllm-project/vllm - 96 versions - Latest release: 8 days ago - 46 dependent packages - 5 dependent repositories - 4.3 million downloads last month
pypi: vllm 0.28.0
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 96 versions - Latest release: 8 days ago - 46 dependent packages - 5 dependent repositories - 4.3 million downloads last month
pypi: llm-swarm 0.1.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: over 2 years ago - 72 downloads last month
pypi: llm_math 0.2.0
A tool designed to evaluate the performance of large language models on mathematical tasks.github.com/vllm-project/vllm - 5 versions - Latest release: almost 2 years ago - 114 downloads last month
pypi: moe-kernels 0.8.2
MoE kernelsgithub.com/vllm-project/vllm - 15 versions - Latest release: over 1 year ago - 181 downloads last month
pypi: vllm-emissary 0.1.0
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 2 versions - Latest release: over 1 year ago - 8 downloads last month
pypi: tilearn-infer 0.3.3
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 3 versions - Latest release: over 2 years ago - 12 downloads last month
pypi: llm_atc 0.1.7
Tools for fine tuning and serving LLMsgithub.com/vllm-project/vllm - 6 versions - Latest release: almost 3 years ago - 193 downloads last month
pypi: byzerllm 0.1.182
ByzerLLM: Byzer LLMgithub.com/vllm-project/vllm - 178 versions - Latest release: over 1 year ago - 1 dependent package - 2 dependent repositories - 8.85 thousand downloads last month
pypi: vllm-consul 0.2.1
A high-throughput and memory-efficient inference and serving engine for LLMsgithub.com/vllm-project/vllm - 5 versions - Latest release: almost 3 years ago - 46 downloads last month