GGUF 格式一种存储量化模型的文件格式,广泛用于 llama.cpp、Ollama 等本地运行 LLM。单个 .gguf 文件打包了权重与元数据,文件名通常标注量化级别(如 Q4_K_M)。位数越高越精确,但体积更大、速度更慢。