コンテンツへスキップ

知識蒸留

小さな「生徒」モデルに大きな「教師」モデルを模倣させ、低コストで品質を維持する。

高速で安価な「mini」「flash」系モデルの多くは大きな旗艦モデルから蒸留され、わずかな精度と引き換えに大幅な低遅延・低コストを得る。大量処理の本番利用に最適。

関連リソース