モデル抽出

term_id: model_extraction

Category: ethics_safety

Definition

モデル抽出では、攻撃者はターゲット機械学習モデルのAPIをクエリして、その内部構造、重み、または意思決定境界を推測します。これらのクエリを使用して、元のモデルの挙動を模倣するサロゲートモデル(代理モデル)を構築します。

Summary

攻撃者がモデルにクエリを送信してパラメータを再構築または複製を作成する攻撃手法。

Key Concepts

  • サロゲートモデリング
  • APIクエリ
  • 知的財産権侵害
  • 敵対的攻撃

Use Cases

  • 商用AI APIのセキュリティ監査
  • 独自アルゴリズムのクローン作成からの保護
  • 抽出攻撃に対する防御メカニズムの研究