Código abiertoAvanzado
vLLM High-Performance Inference Framework
A high-throughput inference and serving framework for large language models that significantly improves deployment efficiency via PagedAttention.
Descripción general
"vLLM High-Performance Inference Framework" es un recurso de tipo "Código abierto" seleccionado por AI Resource Hub, clasificado en la categoría Frameworks y adecuado para estudiantes de nivel Avanzado. Lo proporciona vLLM, se actualizó por última vez el 2026-06-26 y tiene una valoración general de 4.7/5 (a partir de 1,900 reseñas). Haz clic en "Visitar recurso" a la derecha para abrir la página original.
Etiquetas
vLLMInferenceHigh-PerformanceDeployment
Visitar recurso →
Detalles
- Autor
- vLLM
- Valoración
- ★ 4.7 (1,900 reseñas)
- Última actualización
- 26 jun 2026