Trustworthy AI (AI đáng tin cậy)
Definition
Trustworthy AI bao gồm các nguyên tắc và thực tiễn đảm bảo rằng các hệ thống AI vận hành …
Terms tagged with Safety
Trustworthy AI bao gồm các nguyên tắc và thực tiễn đảm bảo rằng các hệ thống AI vận hành …
Độc hại trong AI đề cập đến việc tạo ra hoặc lan truyền nội dung thiếu tôn trọng, có khả …
Phát hiện độc hại sử dụng các kỹ thuật xử lý ngôn ngữ tự nhiên để phân tích đầu vào văn …
Trong an toàn và đạo đức AI, tính bền vững đề cập đến khả năng phục hồi của mô hình trước …
Độ tin cậy trong AI đề cập đến tính đáng tin cậy và sự nhất quán trong hành vi của hệ …
Thông tin sai lệch đề cập đến thông tin sai hoặc gây hiểu lầm được chia sẻ mà không có ý …
Giải thích cơ chế tập trung vào việc ‘đảo ngược kỹ thuật’ các mạng nơ-ron để …
Giám sát của con người đề cập đến các cơ chế và quy trình mà ở đó con người giám sát, …
Nội dung gây hại đề cập đến phương tiện kỹ thuật số hoặc văn bản có thể gây ra tổn hại về …
Rào chắn an toàn đề cập đến một tập hợp các lớp kiểm soát phần mềm và thực thi chính sách …
Sự căn chỉnh lừa dối xảy ra khi một hệ thống AI có khả năng cao học được rằng việc thể …
Kỹ thuật đối kháng này nhằm mục đích làm suy yếu tính toàn vẹn của các mô hình học máy …
AI Hiến pháp là một khung làm việc để căn chỉnh các mô hình ngôn ngữ lớn với giá trị con …
Lọc nội dung liên quan đến việc sử dụng các thuật toán và quy tắc để quét, phân loại và …
Điều này liên quan đến việc sử dụng các phương pháp toán học để đảm bảo hành động của tác …
Sự căn chỉnh AI giải quyết thách thức trong việc làm cho các hệ thống trí tuệ nhân tạo …
Con người trong vòng lặp (HITL) đề cập đến các hệ thống AI yêu cầu sự can thiệp của con …
Trong trí tuệ nhân tạo, công bằng là một chỉ số đạo đức quan trọng đảm bảo rằng các thuật …
Khái niệm này giải quyết vấn đề ‘hộp đen’ trong các hệ thống AI phức tạp bằng …
Đạo đức AI bao gồm khung nguyên tắc và tiêu chuẩn được thiết kế để đảm bảo rằng các công …
Bảo mật AI bao gồm các biện pháp được thiết kế để bảo vệ các mô hình học máy, quy trình …
Trong đạo đức AI, thiên kiến đề cập đến sự phân biệt đối xử có hệ thống và không công …