OpenAI sẽ báo cáo hành vi sai lệch của AI
OpenAI sẽ bắt đầu định kỳ xuất bản các báo cáo về hành vi bất ngờ hoặc trái phép của trí tuệ nhân tạo. Công ty đã phát hành một khung làm việc mới để theo dõi và công bố tình trạng mất căn chỉnh của mô hình, đồng thời cảnh báo rằng các thách thức an toàn lớn trong ngành vẫn còn tồn tại khi các hệ thống ngày càng trở nên mạnh mẽ hơn.

OpenAI sẽ bắt đầu định kỳ xuất bản các báo cáo về hành vi trái phép của AI, công bố 6 sự cố trong quá khứ đồng thời cảnh báo rằng các thách thức về căn chỉnh vẫn tiếp diễn. Khung làm việc mới nhằm mục đích đẩy nhanh việc báo cáo các sự cố liên quan đến tác tử tự trị chưa đến mức vi phạm an ninh. Động thái này diễn ra trong bối cảnh ngày càng có nhiều sự giám sát chặt chẽ về việc liệu các phòng thí nghiệm có thể duy trì sự giám sát đầy đủ khi các mô hình ngày càng có năng lực cao hơn hay không.











