Aller au contenu

GGUF

Format de fichier pour modèles quantifiés, très utilisé pour exécuter des LLM en local avec llama.cpp ou Ollama.

Un seul fichier .gguf regroupe poids et métadonnées, et le nom indique en général le niveau de quantification (Q4_K_M, par exemple). Plus de bits : plus de précision, mais aussi plus lourd et plus lent.

Ressources associées