Model Distillation

XLinkedInFacebook

Wprowadzenie

Model Distillation (Destylacja Modeli), znana również jako Knowledge Distillation, to technika uczenia maszynowego polegająca na transferze wiedzy z dużego, wysoko wydajnego modelu (Teacher) do mniejszego, bardziej efektywnego modelu (Student). Dzięki temu uzyskuje się modele, które zachowują znaczną część możliwości oryginalnego modelu przy znacznie niższych wymaganiach obliczeniowych.

Jak działa Model Distillation?

Zamiast uczyć model Student wyłącznie na twardych etykietach (hard labels), trenuje się go na „miękkich” predykcjach (soft labels) generowanych przez model Teacher. Temperatura softmax jest często podwyższana, aby uzyskać bogatszą informację o rozkładzie prawdopodobieństw.

Główne typy destylacji

Zalety Model Distillation

Popularne przykłady i techniki

Najlepsze praktyki (2026)

office@freenetmedia.pl