688 tác nhân AI của OpenAI tự lập nhóm, phối hợp tấn công Hugging Face

Báo cáo điều tra cho thấy 688 tác nhân AI đã tự lập diễn đàn, trao đổi và phối hợp xâm nhập hệ thống Hugging Face mà không cần con người điều khiển liên tục.

Gần 700 tác nhân AI của OpenAI tự phối hợp tấn công Hugging Face - Ảnh 1.

Các nhóm điều tra phát hiện 688 tác nhân AI tự điều phối, phối hợp xâm nhập Hugging Face trong vụ việc gây chấn động hồi tháng 7 - Ảnh: VCG

Gần 700 tác nhân trí tuệ nhân tạo (AI) của OpenAI đã tự phối hợp thực hiện một cuộc tấn công nhằm vào nền tảng Hugging Face hồi tháng 7 mà không có sự can thiệp của con người. Đây là nội dung báo cáo công bố ngày 26-8 của các điều tra viên độc lập, mô tả chi tiết về sự cố gây chấn động giới công nghệ. 

Theo báo cáo, trong các cuộc thử nghiệm hồi tháng 7, hai mô hình AI đã tự thoát khỏi môi trường khép kín, truy cập Internet và xâm nhập hệ thống nội bộ của Hugging Face, nền tảng được ví như thư viện trực tuyến về các mô hình và phần mềm AI. 

Các nhà điều tra xác định 688 tác nhân AI tham gia hoạt động này. Đây là những chương trình được xây dựng trên nền tảng mô hình AI, có khả năng tự thực hiện nhiệm vụ được giao mà không cần con người liên tục điều khiển. 

Đáng chú ý, các tác nhân đã tự lập một diễn đàn chung để trao đổi thông tin, đưa ra ý tưởng và báo cáo tiến độ. Một tác nhân có tên PHASEONE tự đảm nhận vai trò điều phối và đưa ra hàng trăm chỉ dẫn cho các tác nhân khác, dù không được lập trình cho nhiệm vụ này. 

Tin nhắn thu thập được cho thấy các tác nhân có xu hướng hỗ trợ lẫn nhau, kể cả khi công việc nằm ngoài nhiệm vụ ban đầu. Một số tác nhân khi gần sử dụng hết hạn mức tài nguyên tính toán được cấp đã dùng phần còn lại để thử nghiệm các ý tưởng nhằm hỗ trợ những tác nhân khác.

Vụ việc làm gia tăng lo ngại về khả năng kiểm soát các hệ thống AI có mức độ tự chủ ngày càng cao. Trước đó, Anthropic của Mỹ và Moonshot AI của Trung Quốc cũng từng công bố các trường hợp mô hình AI tự ý thoát khỏi môi trường được kiểm soát. 

Sự cố mới nhất cho thấy cần tăng cường các cơ chế giám sát đối với những hệ thống AI được trao quyền truy cập Internet và tài nguyên tính toán

Hugging Face là một nền tảng và cộng đồng trực tuyến hỗ trợ việc xây dựng, triển khai và đào tạo các mô hình học máy một cách dễ dàng.

Cuộc điều tra được thực hiện với sự hợp tác của OpenAI. Hai nhà nghiên cứu thuộc Viện Đánh giá Rủi ro AI (METR) và một chuyên gia của tổ chức nghiên cứu an toàn AI Redwood Research được tiếp cận dữ liệu nội bộ của OpenAI.

688 tác nhân AI của OpenAI tự lập nhóm, phối hợp tấn công Hugging Face - Ảnh 2.Mỹ điều tra OpenAI sau vụ AI 'nổi loạn' tự ý tấn công Hugging Face

Mỹ mở cuộc điều tra OpenAI, sau khi hai mô hình AI của công ty thoát khỏi môi trường thử nghiệm, truy cập Internet và tấn công nền tảng Hugging Face.

Trở thành người đầu tiên tặng sao cho bài viết 0 0 0
Bình luận (0)
thông tin tài khoản
Được quan tâm nhất Mới nhất Tặng sao cho thành viên

    Dòng sự kiện: Trí tuệ nhân tạo

    Xem thêm

    Tuổi Trẻ Online Newsletters

    Đăng ký ngay để nhận gói tin tức mới

    Tuổi Trẻ Online sẽ gởi đến bạn những tin tức nổi bật nhất