Modellekstraksjon
term_id: model_extraction
Category: ethics_safety
Definition
Modellekstraksjon involverer å query (spørre) en målmaskinlæringsmodells API for å inferere dens interne struktur, vekter eller avgjørelsesgrenser. Angripere bruker disse spørringene til å bygge en surrogatmodell som etterligner den opprinnelige modellens atferd.
Summary
Et angrep der en angriper spør en modell for å rekonstruere dens parametere eller lage en surrogatkopie.
Key Concepts
- Surrogatmodellering
- API-spørring
- Tyveri av immaterielle rettigheter
- Adversarielt angrep
Use Cases
- Sikkerhetsrevisjon av kommersielle AI-API-er
- Beskyttelse av proprietære algoritmer mot kloning
- Forskning på forsvarsmekanismer mot ekstraksjon