Modell-Extraktion
term_id: model_extraction
Category: ethics_safety
Definition
Bei der Modell-Extraktion wird die API eines Ziel-Maschinenlernmodells abgefragt, um dessen interne Struktur, Gewichte oder Entscheidungsgrenzen zu erschließen. Angreifer nutzen diese Abfragen, um ein surrogatives Modell zu erstellen, das
Summary
Ein Angriff, bei dem ein Angreifer ein Modell abfragt, um seine Parameter zu rekonstruieren oder eine surrogative Kopie zu erstellen.
Key Concepts
- Surrogatmodellierung
- API-Abfrage
- Diebstahl geistigen Eigentums
- Adversarialer Angriff
Use Cases
- Sicherheitsaudits kommerzieller KI-APIs
- Schutz proprietärer Algorithmen vor Klonen
- Forschung an Abwehrmechanismen gegen Extraktion