Inferência

term_id: inference

Category: engineering_practice

Definition

Inferência refere-se à etapa de implantação onde um modelo finalizado é usado para tomar decisões ou fazer previsões sobre dados não vistos. Diferentemente do treinamento, que atualiza os pesos, a inferência consome recursos computacionais para gerar resultados.

Summary

A fase em que um modelo treinado processa novos dados para gerar previsões ou saídas.

Key Concepts

  • Previsão
  • Latência
  • Taxa de Transferência (Throughput)
  • Implantação (Deployment)

Use Cases

  • Detecção de fraude em tempo real em transações bancárias
  • Geração de respostas em interações ao vivo com chatbots
  • Classificação de imagens em sistemas de veículos autônomos

Code Example

1
2
3
4
5
import torch
model.eval()
with torch.no_grad():
    output = model(input_tensor)
    prediction = torch.argmax(output, dim=1)