Phát hiện độc hại

term_id: toxicity_detection

Category: application_paradigms

Definition

Phát hiện độc hại sử dụng các kỹ thuật xử lý ngôn ngữ tự nhiên để phân tích đầu vào văn bản và gán điểm xác suất cho biết khả năng xuất hiện nội dung gây hại. Các hệ thống này thường sử dụng dữ liệu được gắn nhãn để huấn luyện các mô hình phân loại.

Summary

Quy trình tự động xác định và phân loại ngôn ngữ gây hại hoặc lạm dụng trong văn bản bằng cách sử dụng các mô hình học máy.

Key Concepts

  • Phân loại văn bản
  • Học máy
  • Kiểm duyệt
  • NLP

Use Cases

  • Kiểm duyệt nội dung tự động
  • Lọc trò chuyện thời gian thực
  • Giám sát danh tiếng thương hiệu