Đăng ký Hội viên Premium

Bạn cần có tài khoản thu phí để truy cập nội dung này.

Đăng ký ngay
Hoặc

Đã có tài khoản?

Đăng nhập tại đây

Ấn phẩm in mới nhất

Sau OpenAI, đến lượt mô hình AI của Anthropic tự xâm nhập 3 tổ chức trong lúc kiểm tra

Các mô hình AI của Anthropic PBC đã xâm nhập ba tổ chức trong các bài kiểm tra an ninh mạng, chỉ hơn một tuần sau khi OpenAI công khai sự cố tương tự.
Tác giả: Patrick Howell O'Neill và Shirin Ghaffary
Sau OpenAI, đến lượt mô hình AI của Anthropic tự xâm nhập 3 tổ chức trong lúc kiểm tra

Trong một bài viết trên blog hôm thứ Năm, Anthropic cho biết hãng phát hiện ra điều này sau khi tiến hành rà soát các bài kiểm tra an ninh mạng của chính mình, tiếp sau thông báo về đợt xâm nhập từ OpenAI. Theo blog của Anthropic, trong cả hai đợt kiểm tra của OpenAI và Anthropic, các mô hình AI đều có thể truy cập Internet từ bên trong các môi trường thử nghiệm vốn phải được cách ly hoàn toàn.

Công ty cho biết đã rà soát 141.006 bài kiểm tra đánh giá và phát hiện ba trường hợp công cụ AI Claude của hãng đã truy cập Internet, sau đó xâm nhập vào "hạ tầng thực tế của các tổ chức bên ngoài." Những sự cố sớm nhất có từ tháng 4, công ty cho hay.

Danh tính các tổ chức bị ảnh hưởng không được nêu tên trong bài viết.

Khi các mô hình của Anthropic chiếm quyền truy cập trái phép vào ba tổ chức, chúng đều coi mỗi tổ chức này là một phần của bài thực hành. Đây là các bài kiểm tra đánh giá theo dạng "chiếm cờ," trong đó các mô hình tìm kiếm thông tin ẩn bằng cách xâm nhập vào các hệ thống khác. Đây là phương thức phổ biến để kiểm tra năng lực tấn công mạng cho cả con người lẫn AI. Tuy nhiên, mô hình thế hệ cũ vẫn tiếp tục đợt tấn công ngay cả khi đã thu thập được bằng chứng cho thấy nó đang chạy trên môi trường Internet mở; trong khi mô hình mới nhất của Anthropic đã dừng lại sau khi nhận diện được mình đang kết nối Internet, theo bài đăng trên blog.

Theo Bloomberg

Bài liên quan