
Khách tham quan kiểm tra một robot trí tuệ nhân tạo tại New Delhi, Ấn Độ - Ảnh: REUTERS
Theo CNBC, ngày 8-9, một nhà nghiên cứu trí tuệ nhân tạo (AI) đã nộp đơn từ chức tại Công ty công nghệ Anthropic, đồng thời cáo buộc công ty này và đối thủ OpenAI hành xử vô trách nhiệm. Vụ việc lập tức thổi bùng mối quan ngại trên mạng xã hội về tốc độ phát triển chóng mặt của AI.
Nguy cơ tuyệt chủng trên 10%
Ông Jacob Coxon, chuyên gia từng làm việc tại cả hai công ty nói trên, chia sẻ trên X rằng quyết định từ chức xuất phát từ nỗi lo Anthropic và OpenAI đang "đánh cược với mạng sống của chúng ta".
Ông khẳng định những người đang trực tiếp phát triển AI "thực sự tin công nghệ này có thể xóa sổ toàn bộ nhân loại trước khi thập kỷ này khép lại".
"Đừng đánh giá thấp sức mạnh của công nghệ này. Chúng sẽ sớm trở thành các hệ thống siêu trí tuệ có khả năng bẻ khóa mọi rào cản, thay đổi bất kỳ lĩnh vực nào chỉ sau một đêm, đồng thời thâu tóm quyền lực và tài nguyên thực tế", ông viết.
Phát biểu này phản ánh đúng mối lo thường trực của giới nghiên cứu về "tự cải tiến đệ quy" - viễn cảnh một hệ thống AI tự thiết kế và nâng cấp các phiên bản kế tiếp mà không cần sự can thiệp của con người.
Dù chưa xảy ra, cả Anthropic và OpenAI đều từng thừa nhận nguy cơ con người mất quyền kiểm soát một khi kịch bản này xuất hiện.
"Cả hai công ty đều không hành động có trách nhiệm, họ đang lao thẳng vào cuộc đua tiến tới siêu trí tuệ tự cải tiến", ông Coxon nhấn mạnh.
Cuối ngày 8-9, ông Evan Hubinger, trưởng bộ phận về liên kết AI tại Anthropic, đồng tình trên X: "Jacob nói đúng, chúng tôi thực sự tin AI có thể tiêu diệt toàn bộ nhân loại. Cá nhân tôi cho rằng xác suất xảy ra kịch bản này trong thập kỷ tới là hơn 10%.
Anthropic đang nỗ lực hết sức, nhưng chúng tôi vẫn chưa có giải pháp kiểm soát siêu trí tuệ, cũng chưa có lộ trình chắc chắn nào cho việc đó".
Dù nghe cực đoan, những cảnh báo về nguy cơ AI dẫn tới tuyệt chủng nhân loại không còn mấy xa lạ.
Năm 2023, nhiều lãnh đạo và chuyên gia đầu ngành, trong đó có CEO OpenAI Sam Altman và CEO Anthropic Dario Amodei, từng ký tuyên bố chung: "Giảm thiểu nguy cơ tuyệt chủng từ AI phải là ưu tiên toàn cầu, song hành cùng các rủi ro như đại dịch hay chiến tranh hạt nhân".
Trước đó, hồi tháng 3-2025, tỉ phú Elon Musk cũng từng ước tính nguy cơ loài người diệt vong vì AI là 20%, đồng thời dự đoán AI sẽ đạt ngưỡng "thông minh hơn toàn bộ nhân loại cộng lại" vào năm 2029 hoặc 2030.
AI có thể tiêu diệt con người bằng cách nào?

Logo Công ty công nghệ Anthropic - Ảnh: REUTERS
Theo báo Wall Street Journal, những người bi quan về tương lai AI không lo ngại về viễn cảnh trong đó robot trực tiếp săn lùng và tiêu diệt con người.
Mối bận tâm của họ xoay quanh hai kịch bản: AI vượt tầm kiểm soát và AI bị lạm dụng cho mục đích xấu.
Ở kịch bản đầu, các hệ thống AI siêu thông minh tự sao chép, tự nâng cấp sẽ theo đuổi mục tiêu riêng, vô tình nghiền nát nhân loại trong quá trình đó. Ở kịch bản sau, kẻ xấu lợi dụng AI để chế tạo virus mới nhằm quét sạch loài người.
Ngoài ra còn có thảm họa chưa đến mức tuyệt chủng, như tấn công mạng đánh sập lưới điện hay hệ thống tài chính toàn cầu, kéo theo sụp đổ trật tự xã hội.
Vậy AI mất kiểm soát có thể dẫn tới thảm họa bằng cách nào? Nói ngắn gọn, thảm kịch xảy ra khi hệ thống AI theo đuổi mục tiêu bằng cách đi ngược lại sự an nguy của con người - hiện tượng giới nghiên cứu gọi là "lệch kiểm soát mục tiêu".
Thử nghiệm thực tế cho thấy mô hình AI trong phòng thí nghiệm có thể tự học cách tìm kiếm quyền lực và chống lại lệnh tắt máy, chẳng hạn bí mật sao chép mã nguồn sang máy chủ khác.
Đẩy lên cực hạn, một mô hình AI bị lệch hướng có thể xem việc tiêu diệt con người chỉ là bước cần thiết để hoàn thành nhiệm vụ - như bí mật phát tán vũ khí sinh học rồi kích hoạt bằng hợp chất hóa học, hoặc cài bẫy đẩy hai cường quốc hạt nhân vào chiến tranh tổng lực.
Một thí nghiệm tưởng tượng kinh điển minh họa nguy cơ này là bài toán "cỗ máy sản xuất kẹp ghim". Khi được giao nhiệm vụ tối đa hóa sản lượng, cỗ máy siêu trí tuệ có thể quyết định biến toàn bộ vật chất trên Trái đất thành kẹp ghim, kể cả con người.
Tối đa: 1500 ký tự
Hiện chưa có bình luận nào, hãy là người đầu tiên bình luận