Bezpieczeństwo
term_id: safety
Category: ethics_safety
Definition
Bezpieczeństwo AI (AI Safety) to interdyscyplinarna dziedzina skupiona na zapobieganiu niekorzystnym wynikom zaawansowanej sztucznej inteligencji. Obejmuje wyzwania techniczne, takie jak zgodność celów, interpretowalność i odporność.
Summary
Dziedzina badań i praktyki mająca na celu zapewnienie, że systemy AI nie powodują szkód fizycznych, cyfrowych ani społecznych.
Key Concepts
- Zgodność wartości
- Interpretowalność
- Teoria sterowania
- Ocena ryzyka
Use Cases
- Tworzenie przycisków awaryjnego zatrzymania dla autonomicznych pojazdów
- Audyt algorytmów pod kątem uprzedzeń
- Tworzenie ram regulacyjnych dla wdrożeń AI