Open sourceAvancé
vLLM High-Performance Inference Framework
A high-throughput inference and serving framework for large language models that significantly improves deployment efficiency via PagedAttention.
Aperçu
« vLLM High-Performance Inference Framework » est une ressource de type « Open source » sélectionnée par AI Resource Hub, classée dans la catégorie Frameworks et adaptée aux apprenants de niveau Avancé. Elle est fournie par vLLM, a été mise à jour pour la dernière fois le 2026-06-26 et affiche une note globale de 4.7/5 (sur 1,900 avis). Cliquez sur « Visiter la ressource » à droite pour ouvrir la page d’origine.
Étiquettes
vLLMInferenceHigh-PerformanceDeployment
Visiter la ressource →
Détails
- Auteur
- vLLM
- Note
- ★ 4.7 (1,900 avis)
- Dernière mise à jour
- 26 juin 2026