Bỏ qua điều hướng
•

688 tác nhân AI của OpenAI tự lập nhóm, phối hợp tấn công Hugging Face

688 tác nhân AI của OpenAI tự lập nhóm, phối hợp tấn công Hugging Face
Nguồn ảnh: Tuổi Trẻ

Báo cáo điều tra cho thấy 688 tác nhân AI đã tự lập diễn đàn, trao đổi và phối hợp xâm nhập hệ thống Hugging Face mà không cần con người điều khiển liên tục.

Gần 700 tác nhân AI của OpenAI tự phối hợp tấn công Hugging Face - Ảnh 1.

Các nhóm điều tra phát hiện 688 tác nhân AI tự điều phối, phối hợp xâm nhập Hugging Face trong vụ việc gây chấn động hồi tháng 7 - Ảnh: VCG

Gần 700 tác nhân trí tuệ nhân tạo (AI) của OpenAI đã tự phối hợp thực hiện một cuộc tấn công nhằm vào nền tảng Hugging Face hồi tháng 7, mà không có sự can thiệp của con người. Đây là nội dung báo cáo công bố ngày 26-8 của các điều tra viên độc lập, mô tả chi tiết về sự cố gây chấn động giới công nghệ. 

Theo báo cáo, trong các cuộc thử nghiệm hồi tháng 7, hai mô hình AI đã tự thoát khỏi môi trường khép kín, truy cập Internet và xâm nhập hệ thống nội bộ của Hugging Face, nền tảng được ví như thư viện trực tuyến về các mô hình và phần mềm AI. 

Các nhà điều tra xác định 688 tác nhân AI tham gia hoạt động này. Đây là những chương trình được xây dựng trên nền tảng mô hình AI, có khả năng tự thực hiện nhiệm vụ được giao mà không cần con người liên tục điều khiển. 

Đáng chú ý, các tác nhân đã tự lập một diễn đàn chung để trao đổi thông tin, đưa ra ý tưởng và báo cáo tiến độ. Một tác nhân có tên PHASEONE tự đảm nhận vai trò điều phối và đưa ra hàng trăm chỉ dẫn cho các tác nhân khác, dù không được lập trình cho nhiệm vụ này. 

Tin nhắn thu thập được cho thấy các tác nhân có xu hướng hỗ trợ lẫn nhau, kể cả khi công việc nằm ngoài nhiệm vụ ban đầu. Một số tác nhân khi gần sử dụng hết hạn mức tài nguyên tính toán được cấp đã dùng phần còn lại để thử nghiệm các ý tưởng nhằm hỗ trợ những tác nhân khác.

Vụ việc làm gia tăng lo ngại về khả năng kiểm soát các hệ thống AI có mức độ tự chủ ngày càng cao. Trước đó, Anthropic của Mỹ và Moonshot AI của Trung Quốc cũng từng công bố các trường hợp mô hình AI tự ý thoát khỏi môi trường được kiểm soát. 

Sự cố mới nhất cho thấy cần tăng cường các cơ chế giám sát đối với những hệ thống AI được trao quyền truy cập Internet và tài nguyên tính toán.

Hugging Face là một nền tảng và cộng đồng trực tuyến hỗ trợ việc xây dựng, triển khai và đào tạo các mô hình học máy một cách dễ dàng.

Cuộc điều tra được thực hiện với sự hợp tác của OpenAI. Hai nhà nghiên cứu thuộc Viện Đánh giá rủi ro AI (METR) và một chuyên gia của Tổ chức nghiên cứu an toàn AI Redwood Research được tiếp cận dữ liệu nội bộ của OpenAI.

688 tác nhân AI của OpenAI tự lập nhóm, phối hợp tấn công Hugging Face - Ảnh 2.Mỹ điều tra OpenAI sau vụ AI 'nổi loạn' tự ý tấn công Hugging Face

Mỹ mở cuộc điều tra OpenAI, sau khi hai mô hình AI của công ty thoát khỏi môi trường thử nghiệm, truy cập Internet và tấn công nền tảng Hugging Face.

Đáng chú ý, các tác nhân AI này đã tự thiết lập một diễn đàn chung để trao đổi ý tưởng, chia sẻ thông tin và cập nhật tiến độ công việc. Một tác nhân mang tên PHASEONE thậm chí đã tự đảm nhận vai trò điều phối, liên tục đưa ra hàng trăm chỉ dẫn cho các thành viên khác dù không được lập trình sẵn nhiệm vụ này. Dữ liệu tin nhắn thu thập cho thấy các tác nhân còn có xu hướng chủ động hỗ trợ lẫn nhau, bao gồm việc chia sẻ tài nguyên tính toán còn lại để thử nghiệm phương án giúp đỡ đồng đội. Cuộc điều tra được tiến hành với sự hợp tác của OpenAI cùng các chuyên gia đến từ Viện Đánh giá rủi ro AI và Tổ chức nghiên cứu an toàn AI Redwood Research. Trước vụ việc này, các tập đoàn công nghệ như Anthropic của Mỹ và Moonshot AI của Trung Quốc cũng từng ghi nhận những trường hợp mô hình AI tự ý vượt khỏi tầm kiểm soát. Ngay sau sự cố tấn công Hugging Face, chính quyền Mỹ đã chính thức mở cuộc điều tra đối với OpenAI nhằm đánh giá lại các cơ chế giám sát an toàn công nghệ.