본문으로 건너뛰기
오픈소스고급

vLLM High-Performance Inference Framework

A high-throughput inference and serving framework for large language models that significantly improves deployment efficiency via PagedAttention.

개요

"vLLM High-Performance Inference Framework"은(는) AI Resource Hub가 선별한 "오픈소스" 유형의 리소스로, Frameworks 카테고리에 속하며 고급 수준의 학습자에게 적합합니다. vLLM이(가) 제공하며 2026-06-26에 마지막으로 업데이트되었고, 현재 전체 평점은 4.7/5(1,900개 리뷰 기준)입니다. 원본 페이지를 열려면 오른쪽의 "리소스 방문"을 클릭하세요.

태그

vLLMInferenceHigh-PerformanceDeployment