Inférence

term_id: inference

Category: engineering_practice

Definition

L’inférence fait référence à l’étape de déploiement où un modèle finalisé est utilisé pour prendre des décisions ou faire des prédictions sur des données invisibles. Contrairement à l’entraînement, qui met à jour les poids, l’inférence consomme des ressources informatiques…

Summary

La phase où un modèle entraîné traite de nouvelles données pour générer des prédictions ou des sorties.

Key Concepts

  • Prédiction
  • Latence
  • Débit
  • Déploiement

Use Cases

  • Détection de fraude en temps réel dans les transactions bancaires
  • Génération de réponses lors d’interactions en direct avec un chatbot
  • Classification d’images dans les systèmes de véhicules autonomes

Code Example

1
2
3
4
5
import torch
model.eval()
with torch.no_grad():
    output = model(input_tensor)
    prediction = torch.argmax(output, dim=1)