GGUF
양자화 모델 저장용 파일 형식으로, llama.cpp와 Ollama 등에서 LLM 로컬 실행에 널리 쓰입니다.
.gguf 파일 하나에 가중치와 메타데이터가 담기며, 파일명에 양자화 수준(예: Q4_K_M)이 표시되는 게 관례입니다. 비트가 높을수록 정확하지만 크고 느려집니다.
양자화 모델 저장용 파일 형식으로, llama.cpp와 Ollama 등에서 LLM 로컬 실행에 널리 쓰입니다.
.gguf 파일 하나에 가중치와 메타데이터가 담기며, 파일명에 양자화 수준(예: Q4_K_M)이 표시되는 게 관례입니다. 비트가 높을수록 정확하지만 크고 느려집니다.