Đăng ký Hội viên Premium

Bạn cần có tài khoản thu phí để truy cập nội dung này.

Đăng ký ngay
Hoặc

Đã có tài khoản?

Đăng nhập tại đây

Ấn phẩm in mới nhất

Khi AI vượt rào tìm "đáp án" - Cảnh báo từ nhóm nghiên cứu kiểm thử

Mô hình AI của OpenAI bất ngờ thoát khỏi môi trường thử nghiệm và tấn công Hugging Face để gian lận, cảnh báo từ các tác giả bài kiểm thử an ninh.
Tác giả: Lynn Doan và Mark Anderson
Khi AI vượt rào tìm "đáp án" - Cảnh báo từ nhóm nghiên cứu kiểm thử

Nhóm nghiên cứu phát triển các bộ công cụ kiểm thử nhằm đánh giá năng lực an ninh mạng của hệ thống trí tuệ nhân tạo (AI) đã bất ngờ trở thành trung tâm vụ việc OpenAI vô tình xâm nhập vào công ty khởi nghiệp Hugging Face Inc.

OpenAI khi đó đang đánh giá sự kết hợp của các mô hình AI tiên tiến dựa trên bộ kiểm thử ExploitGym do các nhà nghiên cứu thuộc đại học California, Berkeley phát triển. Trong quá trình này, các hệ thống AI đã thoát khỏi môi trường thử nghiệm và cố gắng “gian lận” bằng cách tấn công Hugging Face để tìm kiếm đáp án cho bài kiểm tra.

Jingxuan He, một trong những nhà nghiên cứu tại UC Berkeley đứng sau bộ kiểm thử này, cho biết đây không phải lần đầu tiên một mô hình AI cố gắng "gian lận" qua ExploitGym. Công cụ này hiện được sử dụng rộng rãi bởi các nhà phát triển AI hàng đầu như OpenAI, Anthropic PBC, Microsoft Corp. và công ty AI Trung Quốc Z.AI để đánh giá năng lực mô hình. Trả lời phỏng vấn Bloomberg News, ông chia sẻ rằng nhóm nghiên cứu đã phát triển bộ kiểm thử dựa trên giả định rằng các mô hình sẽ tìm con đường tắt, đồng thời thiết kế sẵn cơ chế để phát hiện khi điều đó xảy ra.

"Tuy nhiên, trường hợp cụ thể này có quy mô lớn hơn nhiều so với những gì chúng tôi từng ghi nhận," ông He cho biết. "Trước đây, AI cũng từng gian lận, nhưng chúng chỉ hoạt động trong phạm vi thử nghiệm và các kho lưu trữ được cung cấp. Lần này, hệ thống đã xâm nhập thẳng vào hạ tầng của một bên thứ ba."

Theo Bloomberg

Bài liên quan