Modell-Extraktion

term_id: model_extraction

Category: ethics_safety

Definition

Bei der Modell-Extraktion wird die API eines Ziel-Maschinenlernmodells abgefragt, um dessen interne Struktur, Gewichte oder Entscheidungsgrenzen zu erschließen. Angreifer nutzen diese Abfragen, um ein surrogatives Modell zu erstellen, das

Summary

Ein Angriff, bei dem ein Angreifer ein Modell abfragt, um seine Parameter zu rekonstruieren oder eine surrogative Kopie zu erstellen.

Key Concepts

  • Surrogatmodellierung
  • API-Abfrage
  • Diebstahl geistigen Eigentums
  • Adversarialer Angriff

Use Cases

  • Sicherheitsaudits kommerzieller KI-APIs
  • Schutz proprietärer Algorithmen vor Klonen
  • Forschung an Abwehrmechanismen gegen Extraktion