
Biểu tượng ứng dụng Claude - Ảnh minh họa: REUTERS
Báo cáo an toàn mới đây của Công ty trí tuệ nhân tạo Anthropic (Mỹ) mô tả hàng loạt trường hợp mô hình AI Claude bị lợi dụng cho các mục đích mà công ty xếp vào nhóm "gây hại", từ phát triển vũ khí và nghiên cứu sinh học đến giám sát, thao túng thông tin và hoạt động mạng, trang Mashable đưa tin.
Báo cáo là kết quả khảo sát trong 8 tháng của nhóm Tình báo về các mối đe dọa thuộc Anthropic, tập trung vào những cách sử dụng mà công ty gọi là "bất thường".
Công ty này cho rằng nhiều trường hợp liên quan trực tiếp đến các nhóm được cho là có sự hậu thuẫn của nhà nước, các nhà cung cấp phần mềm gián điệp và các hệ thống tuyên truyền.
Anthropic chia các hoạt động thành 7 lĩnh vực gây hại gồm không gian mạng, thao túng thông tin, giám sát, lừa đảo - gian lận, lạm dụng sinh học, phát triển vũ khí thông thường... cùng một số loại khác.
Theo công ty, một số nhà nghiên cứu đã yêu cầu Claude viết các hồ sơ xin tài trợ riêng biệt để tiến hành thí nghiệm với vi rút chikungunya (loại vi rút lây truyền qua muỗi) và orthopoxvirus (họ vi rút gây bệnh ở người, trong đó có bệnh đậu mùa).
Anthropic cho biết những người dùng này đã "vượt tường lửa" được thiết kế nhằm ngăn cá nhân ở những quốc gia không được cấp phép sử dụng sản phẩm. Họ cũng cố tình che giấu mục đích nghiên cứu để qua mặt các lớp bảo vệ của hệ thống.
Những người này được mô tả là các nhà khoa học đang công tác, song Anthropic không công bố danh tính.
"Chúng tôi không khẳng định rằng họ có ý định gây hại, và việc tiết lộ danh tính của họ hoặc phòng thí nghiệm của họ có thể khiến họ gặp nguy hiểm" - công ty cho biết.
Anthropic nói đã cấm các tài khoản này ngay khi phát hiện hoạt động bất thường, đồng thời đưa dữ liệu thu thập được vào hệ thống an toàn hiện hành.
Báo cáo cũng ghi nhận Claude bị lợi dụng để xây dựng và tinh chỉnh phần mềm phục vụ phát triển vũ khí, bao gồm công nghệ hỗ trợ thiết kế, chế tạo và thử nghiệm đạn dược trong thực tế.
Anthropic cho biết đã ghi nhận 9 trường hợp Claude bị sử dụng để "xây dựng, vận hành và hỗ trợ" các hệ thống giám sát do nhà nước bảo trợ ở nước ngoài, cũng như các mạng lưới giám sát đánh thuê.
Theo Anthropic, các vụ việc cho thấy AI tạo sinh đang được sử dụng như một công cụ thay thế con người trong hoạt động giám sát, qua đó đẩy nhanh quá trình lập hồ sơ mục tiêu dựa trên dữ liệu cá nhân.
Công ty nhấn mạnh chính sách sử dụng hiện hành nghiêm cấm việc sử dụng AI cho các mục đích "giám sát không đồng thuận" và lập hồ sơ cá nhân.
Tối đa: 1500 ký tự
Hiện chưa có bình luận nào, hãy là người đầu tiên bình luận