Modellekstraksjon

term_id: model_extraction

Category: ethics_safety

Definition

Modellekstraksjon involverer å query (spørre) en målmaskinlæringsmodells API for å inferere dens interne struktur, vekter eller avgjørelsesgrenser. Angripere bruker disse spørringene til å bygge en surrogatmodell som etterligner den opprinnelige modellens atferd.

Summary

Et angrep der en angriper spør en modell for å rekonstruere dens parametere eller lage en surrogatkopie.

Key Concepts

  • Surrogatmodellering
  • API-spørring
  • Tyveri av immaterielle rettigheter
  • Adversarielt angrep

Use Cases

  • Sikkerhetsrevisjon av kommersielle AI-API-er
  • Beskyttelse av proprietære algoritmer mot kloning
  • Forskning på forsvarsmekanismer mot ekstraksjon