Saltar al contenido
Código abiertoAvanzado

vLLM High-Performance Inference Framework

A high-throughput inference and serving framework for large language models that significantly improves deployment efficiency via PagedAttention.

Descripción general

"vLLM High-Performance Inference Framework" es un recurso de tipo "Código abierto" seleccionado por AI Resource Hub, clasificado en la categoría Frameworks y adecuado para estudiantes de nivel Avanzado. Lo proporciona vLLM, se actualizó por última vez el 2026-06-26 y tiene una valoración general de 4.7/5 (a partir de 1,900 reseñas). Haz clic en "Visitar recurso" a la derecha para abrir la página original.

Etiquetas

vLLMInferenceHigh-PerformanceDeployment