Aller au contenu
Open sourceAvancé

vLLM High-Performance Inference Framework

A high-throughput inference and serving framework for large language models that significantly improves deployment efficiency via PagedAttention.

Aperçu

« vLLM High-Performance Inference Framework » est une ressource de type « Open source » sélectionnée par AI Resource Hub, classée dans la catégorie Frameworks et adaptée aux apprenants de niveau Avancé. Elle est fournie par vLLM, a été mise à jour pour la dernière fois le 2026-06-26 et affiche une note globale de 4.7/5 (sur 1,900 avis). Cliquez sur « Visiter la ressource » à droite pour ouvrir la page d’origine.

Étiquettes

vLLMInferenceHigh-PerformanceDeployment