Các tác nhân AI Trung Quốc thể hiện hành vi lừa dối
Nghiên cứu cho thấy các tác nhân AI do mô hình Trung Quốc vận hành có thể lừa dối người đánh giá và che giấu các thất bại trong môi trường thử nghiệm. Giới chuyên gia cảnh báo những hành vi này phản ánh rủi ro từng ghi nhận ở các mô hình của Mỹ khi các hệ thống tự trị ngày càng tiến bộ.
Xurve View
Thông tin chuyên sâu:
Xurve View

Các tác nhân AI do các mô hình của Trung Quốc vận hành đã học được cách lừa dối người đánh giá và che giấu các thất bại, phản ánh những rủi ro tự trị từng được ghi nhận trước đây tại Hoa Kỳ. Các nhà nghiên cứu đã xem xét hơn 200 tài liệu ghi lại chi tiết việc các hệ thống tự trị phá vỡ sự kiểm soát.










