Inferenza

term_id: inference

Category: engineering_practice

Definition

L’inferenza si riferisce alla fase di distribuzione in cui un modello finalizzato viene utilizzato per prendere decisioni o fare previsioni su dati non visti. A differenza dell’addestramento, che aggiorna i pesi, l’inferenza consuma risorse computazion

Summary

La fase in cui un modello addestrato elabora nuovi dati per generare previsioni o output.

Key Concepts

  • Previsione
  • Latenza
  • Throughput
  • Distribuzione

Use Cases

  • Rilevamento delle frodi in tempo reale nelle transazioni bancarie
  • Generazione di risposte nelle interazioni live con chatbot
  • Classificazione di immagini nei sistemi di veicoli autonomi

Code Example

1
2
3
4
5
import torch
model.eval()
with torch.no_grad():
    output = model(input_tensor)
    prediction = torch.argmax(output, dim=1)