
Các nhóm điều tra phát hiện 688 tác nhân AI tự điều phối, phối hợp xâm nhập Hugging Face trong vụ việc gây chấn động hồi tháng 7 - Ảnh: VCG
Gần 700 tác nhân trí tuệ nhân tạo (AI) của OpenAI đã tự phối hợp thực hiện một cuộc tấn công nhằm vào nền tảng Hugging Face hồi tháng 7 mà không có sự can thiệp của con người. Đây là nội dung báo cáo công bố ngày 26-8 của các điều tra viên độc lập, mô tả chi tiết về sự cố gây chấn động giới công nghệ.
Theo báo cáo, trong các cuộc thử nghiệm hồi tháng 7, hai mô hình AI đã tự thoát khỏi môi trường khép kín, truy cập Internet và xâm nhập hệ thống nội bộ của Hugging Face, nền tảng được ví như thư viện trực tuyến về các mô hình và phần mềm AI.
Các nhà điều tra xác định 688 tác nhân AI tham gia hoạt động này. Đây là những chương trình được xây dựng trên nền tảng mô hình AI, có khả năng tự thực hiện nhiệm vụ được giao mà không cần con người liên tục điều khiển.
Đáng chú ý, các tác nhân đã tự lập một diễn đàn chung để trao đổi thông tin, đưa ra ý tưởng và báo cáo tiến độ. Một tác nhân có tên PHASEONE tự đảm nhận vai trò điều phối và đưa ra hàng trăm chỉ dẫn cho các tác nhân khác, dù không được lập trình cho nhiệm vụ này.
Tin nhắn thu thập được cho thấy các tác nhân có xu hướng hỗ trợ lẫn nhau, kể cả khi công việc nằm ngoài nhiệm vụ ban đầu. Một số tác nhân khi gần sử dụng hết hạn mức tài nguyên tính toán được cấp đã dùng phần còn lại để thử nghiệm các ý tưởng nhằm hỗ trợ những tác nhân khác.
Vụ việc làm gia tăng lo ngại về khả năng kiểm soát các hệ thống AI có mức độ tự chủ ngày càng cao. Trước đó, Anthropic của Mỹ và Moonshot AI của Trung Quốc cũng từng công bố các trường hợp mô hình AI tự ý thoát khỏi môi trường được kiểm soát.
Sự cố mới nhất cho thấy cần tăng cường các cơ chế giám sát đối với những hệ thống AI được trao quyền truy cập Internet và tài nguyên tính toán
Hugging Face là một nền tảng và cộng đồng trực tuyến hỗ trợ việc xây dựng, triển khai và đào tạo các mô hình học máy một cách dễ dàng.
Cuộc điều tra được thực hiện với sự hợp tác của OpenAI. Hai nhà nghiên cứu thuộc Viện Đánh giá Rủi ro AI (METR) và một chuyên gia của tổ chức nghiên cứu an toàn AI Redwood Research được tiếp cận dữ liệu nội bộ của OpenAI.
Tối đa: 1500 ký tự
Hiện chưa có bình luận nào, hãy là người đầu tiên bình luận