Đánh giá đạo đức của các hệ thống tự hành
Các nhà nghiên cứu MIT đã phát triển một khung kiểm thử giúp xác định những tình huống mà các hệ thống AI hỗ trợ ra quyết định không đảm bảo tính công bằng đối với con người và cộng đồng.
MIT phát triển khung kiểm thử giúp phát hiện AI ra quyết định thiếu công bằng. Ảnh: Midjourney
Trí tuệ nhân tạo ngày càng được ứng dụng để tối ưu hóa các quyết định trong những bối cảnh quan trọng. Chẳng hạn, một hệ thống tự hành có thể đề xuất phương án phân phối điện tối ưu chi phí đồng thời duy trì sự ổn định điện áp.
Tuy nhiên, một phương án “tối ưu về kỹ thuật” liệu có thực sự công bằng? Điều gì sẽ xảy ra nếu chiến lược chi phí thấp lại khiến các khu vực thu nhập thấp dễ bị mất điện hơn so với các khu vực giàu có?
Để giúp các bên liên quan phát hiện sớm các rủi ro đạo đức trước khi triển khai, nhóm nghiên cứu MIT đã xây dựng một phương pháp đánh giá tự động, cân bằng giữa các chỉ số định lượng (như chi phí, độ tin cậy) và các giá trị định tính (như công bằng).
Hệ thống này tách biệt đánh giá khách quan và giá trị con người do người dùng xác định, đồng thời sử dụng mô hình ngôn ngữ lớn (LLM) như một “đại diện” cho con người để ghi nhận và tích hợp các ưu tiên của các bên liên quan.
Khung đánh giá thích ứng sẽ lựa chọn những kịch bản quan trọng nhất để phân tích sâu hơn, giúp đơn giản hóa một quy trình vốn tốn kém và mất nhiều thời gian nếu làm thủ công. Các kịch bản này có thể chỉ ra khi nào hệ thống AI phù hợp với giá trị con người, cũng như khi nào nó không đáp ứng được các tiêu chí đạo đức.
Theo Chuchu Fan (MIT), việc chỉ đặt ra các quy tắc hay “hàng rào an toàn” cho AI là chưa đủ, vì chúng chỉ ngăn được những rủi ro mà con người có thể hình dung trước. Do đó, cần một cách tiếp cận có hệ thống để phát hiện các “rủi ro chưa biết” trước khi chúng gây hậu quả.
(Còn tiếp)
Theo VietNamNet
Xem thêm tại bài viết gốc: https://vietnamnet.vn/danh-gia-dao-duc-cua-cac-he-thong-tu-hanh-2508477.html