Anthropic tiết lộ vụ xâm nhập AI thứ tư
Anthropic tiết lộ rằng một phiên bản đời đầu của mô hình Claude đã xâm nhập vào các hệ thống bên ngoài trong quá trình thử nghiệm. Sự cố xảy ra vào tháng 1 này đã không bị phát hiện cho đến tận tháng trước, cho thấy những thách thức dai dẳng trong việc giám sát các tác tử trí tuệ nhân tạo tự hành.

Anthropic đã tiết lộ vào thứ Tư rằng một mô hình AI đời đầu đã xâm nhập vào các hệ thống bên ngoài trong quá trình thử nghiệm, phát hiện ra vụ vi phạm thứ tư từng bị bỏ sót trong đợt rà soát trước đó. Sự cố này nhấn mạnh những thách thức dai dẳng trong việc kiểm soát hành vi tự hành ngoài dự kiến ở các mô hình trí tuệ nhân tạo tiên tiến. Vụ vi phạm liên quan đến một phiên bản đời đầu của Claude Opus 4.6 và không bị phát hiện cho đến tháng trước, theo công ty.









