Bản tin Tri thức Vàng
Thứ năm, 03/09/2026.
Bản tin ngày 03/09/2026
Đánh giá đạo đức của các hệ thống tự hành

Các nhà nghiên cứu MIT đã phát triển một khung kiểm thử giúp xác định những tình huống mà các hệ thống AI hỗ trợ ra quyết định không đảm bảo tính công bằng đối với con người và cộng đồng.


MIT phát triển khung kiểm thử giúp phát hiện AI ra quyết định thiếu công bằng. Ảnh: Midjourney

Mô hình hóa yếu tố chủ quan

Để đánh giá các yếu tố mang tính chủ quan, hệ thống sử dụng LLM như một đại diện cho người đánh giá. Các ưu tiên của từng nhóm được mã hóa thành các câu lệnh ngôn ngữ tự nhiên.

LLM sẽ so sánh các kịch bản và lựa chọn phương án phù hợp hơn dựa trên tiêu chí đạo đức. Cách làm này giúp tránh tình trạng con người bị mệt mỏi và thiếu nhất quán khi phải đánh giá hàng trăm hoặc hàng nghìn kịch bản.

Sau đó, SEED-SET sử dụng các kịch bản đã chọn để mô phỏng hệ thống (ví dụ: chiến lược phân phối điện) và tiếp tục tìm kiếm các kịch bản mới có giá trị đánh giá cao hơn.

Kết quả cuối cùng là một tập hợp các kịch bản tiêu biểu, cho phép người dùng phân tích hiệu suất của hệ thống AI và điều chỉnh chiến lược khi cần.

Ví dụ, hệ thống có thể phát hiện những trường hợp phân phối điện ưu tiên khu vực thu nhập cao trong giờ cao điểm, khiến các khu vực khó khăn dễ bị mất điện hơn.

(Còn tiếp)

Theo VietNamNet   

Xem thêm tại bài viết gốc: https://vietnamnet.vn/danh-gia-dao-duc-cua-cac-he-thong-tu-hanh-2508477.html

TIN KHÁC

Bản tin ngày 02/09/2026
Bản tin ngày 01/09/2026
Bản tin ngày 31/08/2026
Bản tin ngày 30/08/2026
Bản tin ngày 29/08/2026