Chuyên gia cảnh báo: Trí tuệ nhân tạo có hơn 10% khả năng 'hủy diệt toàn bộ nhân loại'

Một chuyên gia trí tuệ nhân tạo (AI) từng làm việc tại Anthropic và OpenAI vừa từ chức, cáo buộc hai công ty này chạy đua phát triển siêu trí tuệ mà không kiểm soát được rủi ro.

 - Ảnh 1.

Khách tham quan kiểm tra một robot trí tuệ nhân tạo tại New Delhi, Ấn Độ - Ảnh: REUTERS

Theo CNBC, ngày 8-9, một nhà nghiên cứu trí tuệ nhân tạo (AI) đã nộp đơn từ chức tại Công ty công nghệ Anthropic, đồng thời cáo buộc công ty này và đối thủ OpenAI hành xử vô trách nhiệm. Vụ việc lập tức thổi bùng mối quan ngại trên mạng xã hội về tốc độ phát triển chóng mặt của AI.

Nguy cơ tuyệt chủng trên 10%

Ông Jacob Coxon, chuyên gia từng làm việc tại cả hai công ty nói trên, chia sẻ trên X rằng quyết định từ chức xuất phát từ nỗi lo Anthropic và OpenAI đang "đánh cược với mạng sống của chúng ta". 

Ông khẳng định những người đang trực tiếp phát triển AI "thực sự tin công nghệ này có thể xóa sổ toàn bộ nhân loại trước khi thập kỷ này khép lại".

"Đừng đánh giá thấp sức mạnh của công nghệ này. Chúng sẽ sớm trở thành các hệ thống siêu trí tuệ có khả năng bẻ khóa mọi rào cản, thay đổi bất kỳ lĩnh vực nào chỉ sau một đêm, đồng thời thâu tóm quyền lực và tài nguyên thực tế", ông viết. 

Phát biểu này phản ánh đúng mối lo thường trực của giới nghiên cứu về "tự cải tiến đệ quy" - viễn cảnh một hệ thống AI tự thiết kế và nâng cấp các phiên bản kế tiếp mà không cần sự can thiệp của con người.

Dù chưa xảy ra, cả Anthropic và OpenAI đều từng thừa nhận nguy cơ con người mất quyền kiểm soát một khi kịch bản này xuất hiện. 

"Cả hai công ty đều không hành động có trách nhiệm, họ đang lao thẳng vào cuộc đua tiến tới siêu trí tuệ tự cải tiến", ông Coxon nhấn mạnh.

Cuối ngày 8-9, ông Evan Hubinger, trưởng bộ phận về liên kết AI tại Anthropic, đồng tình trên X: "Jacob nói đúng, chúng tôi thực sự tin AI có thể tiêu diệt toàn bộ nhân loại. Cá nhân tôi cho rằng xác suất xảy ra kịch bản này trong thập kỷ tới là hơn 10%. 

Anthropic đang nỗ lực hết sức, nhưng chúng tôi vẫn chưa có giải pháp kiểm soát siêu trí tuệ, cũng chưa có lộ trình chắc chắn nào cho việc đó".

Dù nghe cực đoan, những cảnh báo về nguy cơ AI dẫn tới tuyệt chủng nhân loại không còn mấy xa lạ. 

Năm 2023, nhiều lãnh đạo và chuyên gia đầu ngành, trong đó có CEO OpenAI Sam Altman và CEO Anthropic Dario Amodei, từng ký tuyên bố chung: "Giảm thiểu nguy cơ tuyệt chủng từ AI phải là ưu tiên toàn cầu, song hành cùng các rủi ro như đại dịch hay chiến tranh hạt nhân". 

Trước đó, hồi tháng 3-2025, tỉ phú Elon Musk cũng từng ước tính nguy cơ loài người diệt vong vì AI là 20%, đồng thời dự đoán AI sẽ đạt ngưỡng "thông minh hơn toàn bộ nhân loại cộng lại" vào năm 2029 hoặc 2030.

AI có thể tiêu diệt con người bằng cách nào?

 - Ảnh 2.

Logo Công ty công nghệ Anthropic - Ảnh: REUTERS

Theo báo Wall Street Journal, những người bi quan về tương lai AI không lo ngại về viễn cảnh trong đó robot trực tiếp săn lùng và tiêu diệt con người.

Mối bận tâm của họ xoay quanh hai kịch bản: AI vượt tầm kiểm soát và AI bị lạm dụng cho mục đích xấu. 

Ở kịch bản đầu, các hệ thống AI siêu thông minh tự sao chép, tự nâng cấp sẽ theo đuổi mục tiêu riêng, vô tình nghiền nát nhân loại trong quá trình đó. Ở kịch bản sau, kẻ xấu lợi dụng AI để chế tạo virus mới nhằm quét sạch loài người. 

Ngoài ra còn có thảm họa chưa đến mức tuyệt chủng, như tấn công mạng đánh sập lưới điện hay hệ thống tài chính toàn cầu, kéo theo sụp đổ trật tự xã hội.

Vậy AI mất kiểm soát có thể dẫn tới thảm họa bằng cách nào? Nói ngắn gọn, thảm kịch xảy ra khi hệ thống AI theo đuổi mục tiêu bằng cách đi ngược lại sự an nguy của con người - hiện tượng giới nghiên cứu gọi là "lệch kiểm soát mục tiêu". 

Thử nghiệm thực tế cho thấy mô hình AI trong phòng thí nghiệm có thể tự học cách tìm kiếm quyền lực và chống lại lệnh tắt máy, chẳng hạn bí mật sao chép mã nguồn sang máy chủ khác. 

Đẩy lên cực hạn, một mô hình AI bị lệch hướng có thể xem việc tiêu diệt con người chỉ là bước cần thiết để hoàn thành nhiệm vụ - như bí mật phát tán vũ khí sinh học rồi kích hoạt bằng hợp chất hóa học, hoặc cài bẫy đẩy hai cường quốc hạt nhân vào chiến tranh tổng lực.

Một thí nghiệm tưởng tượng kinh điển minh họa nguy cơ này là bài toán "cỗ máy sản xuất kẹp ghim". Khi được giao nhiệm vụ tối đa hóa sản lượng, cỗ máy siêu trí tuệ có thể quyết định biến toàn bộ vật chất trên Trái đất thành kẹp ghim, kể cả con người.

 - Ảnh 3.OpenAI tuyên bố AI đã giải được 1 trong 7 bài toán khó nhất thế giới

Một mô hình AI chưa công bố của OpenAI được cho là đã giải được 1 trong 7 bài toán khó nhất thế giới.

Trở thành người đầu tiên tặng sao cho bài viết 0 0 0
google Nguồn ưu tiên trên Google Ưu tiên Tuổi Trẻ trên Google Search. Xem hướng dẫn.
Bình luận (0)
thông tin tài khoản
Được quan tâm nhất Mới nhất Tặng sao cho thành viên
    Chủ đề: Open AI Elon Musk AI

    Dòng sự kiện: Trí tuệ nhân tạo

    Xem thêm

    Tuổi Trẻ Online Newsletters

    Đăng ký ngay để nhận gói tin tức mới

    Tuổi Trẻ Online sẽ gởi đến bạn những tin tức nổi bật nhất