Compressão de Modelo

term_id: model_compression

Category: training_techniques

Definition

Esta categoria inclui métodos como poda, quantização e destilação de conhecimento, visando reduzir a pegada do modelo enquanto mantém o desempenho. É essencial para implantar modelos de IA complexos.

Summary

A compressão de modelo refere-se a técnicas que reduzem o tamanho e os requisitos computacionais dos modelos de aprendizado de máquina.

Key Concepts

  • Quantização
  • Poda
  • Destilação de Conhecimento
  • Velocidade de Inferência

Use Cases

  • Implantação de modelos em dispositivos móveis
  • Redução de custos de inferência na nuvem
  • Aceleração do processamento de vídeo em tempo real

Code Example

1
2
import torch.quantization as quant
model = quant.quantize_dynamic(model, {torch.nn.Linear}, dtype=torch.qint8)