GGUF
Formato de archivo para modelos cuantizados, muy usado para ejecutar LLMs en local con herramientas como llama.cpp y Ollama.
Un único archivo .gguf empaqueta pesos y metadatos, y el nombre suele indicar el nivel de cuantización (p. ej. Q4_K_M). A más bits, más precisión, pero también más tamaño y menos velocidad.