An toàn AI
term_id: ai_safety
Category: ethics_safety
Definition
An toàn AI bao gồm các nghiên cứu và thực tiễn nhằm đảm bảo rằng các hệ thống tự động hoạt động theo cách có lợi và không gây hại cho con người. Lĩnh vực này giải quyết các rủi ro như thiên kiến, thông tin sai lệch và các mối đe dọa bảo mật.
Summary
Một lĩnh vực nghiên cứu tập trung vào việc ngăn ngừa các hậu quả có hại ngoài ý muốn từ các hệ thống trí tuệ nhân tạo tiên tiến.
Key Concepts
- Độ bền vững (Robustness)
- Đánh giá rủi ro
- Cơ chế an toàn dự phòng (Fail-safes)
- Tính minh bạch
Use Cases
- Quy định đối với xe tự hành
- Kiểm định công cụ chẩn đoán y tế
- Hệ thống phát hiện gian lận tài chính