Inferens

term_id: inference

Category: engineering_practice

Definition

Inferens refererer til udrulningsfasen, hvor en færdig model bruges til at træffe beslutninger eller lave forudsigelser på usete data. I modsætning til træning, som opdaterer vægte, forbruger inferens beregningsressourcer til at køre modellen.

Summary

Fasen, hvor en trænet model behandler ny data for at generere forudsigelser eller outputs.

Key Concepts

  • Forudsigelse
  • Latens
  • Gennemstrømning
  • Udrulning

Use Cases

  • Detektion af svindel i realtid under banktransaktioner
  • Generering af svar i live chatbot-samtaler
  • Klassificering af billeder i autonome køretøjer

Code Example

1
2
3
4
5
import torch
model.eval()
with torch.no_grad():
    output = model(input_tensor)
    prediction = torch.argmax(output, dim=1)