Model Compression

term_id: model_compression

Category: training_techniques

Definition

Denne kategori inkluderer metoder som pruning, kvantisering og videnstileddannelse (knowledge distillation), der sigter mod at mindske modellens fodaftryk, mens ydeevnen opretholdes. Det er afgørende for at udrulle komplekse AI-modeller

Summary

Modelkomprimering refererer til teknikker, der reducerer størrelsen og de beregningsmæssige krav til maskinlæringsmodeller.

Key Concepts

  • Kvantisering
  • Pruning
  • Videnstileddannelse
  • Inferenshastighed

Use Cases

  • Udrulning af modeller på mobile enheder
  • Reduktion af omkostninger til cloud-inferens
  • Accelerering af videobehandling i realtid

Code Example

1
2
import torch.quantization as quant
model = quant.quantize_dynamic(model, {torch.nn.Linear}, dtype=torch.qint8)