Quantisierung
Die numerische Präzision der Gewichte reduzieren (z. B. auf 4 Bit), um Modelle zu verkleinern und auf schwächerer Hardware zu betreiben.
Ein auf 4 Bit quantisiertes Modell braucht etwa ein Viertel des 16-Bit-Originals – so läuft ein 7B–8B-Modell auf dem Laptop, mit meist verschmerzbarem Qualitätsverlust.