Cái giá của cuộc đua AI vô tội vạ: Mô hình của OpenAI nổi loạn

Khi AI trở thành một phần năng lực chủ quyền quốc gia, cách các cường quốc AI theo đuổi công nghệ có thể định hình vận mệnh sau này.

Sự cố OpenAI 'sổ lồng' đáng báo động đến mức nào? - Ảnh 1.

Vụ mô hình OpenAI tự ý tấn công Hugging Face cho thấy những dấu hiệu AI đang trượt dần khỏi tầm kiểm soát của con người - Ảnh: REUTERS

Ngày 21-7, thế giới công nghệ chấn động khi OpenAI xác nhận hai mô hình của mình là thủ phạm vụ tấn công mạng chưa từng có nhắm vào nền tảng lưu trữ AI nổi tiếng Hugging Face. 

Những tình tiết của vụ việc này một lần nữa dấy lên không ít lo ngại về độ an toàn của cách con người theo đuổi công nghệ này.

Khi AI làm điều con người không lường trước

Công nghệ AI tiến rộng rãi vào cuộc sống hằng ngày từ năm 2022, sau khi OpenAI ra mắt ChatGPT. Tuy nhiên, với những người theo dõi văn hóa đại chúng cuối thế kỷ 20, khái niệm AI có lẽ đã không còn quá lạ lẫm.

Từ thập niên 1980 đến đầu 2000, thế giới từng trầm trồ với hai loạt phim khoa học viễn tưởng là Kẻ hủy diệt (The Terminator) và Ma trận (The Matrix).

Trong Kẻ hủy diệt, Skynet là mạng lưới phòng thủ vận hành bằng AI do quân đội Mỹ tạo ra. Khi có được sự tự nhận thức và phát hiện con người đang tìm cách tắt nó đi, hệ thống này đã phát động chiến tranh hạt nhân chống lại loài người.

Trong Ma trận (The Matrix), máy móc tự nhận thức, tự lập quốc gia riêng và cạnh tranh với con người. Khi quốc gia máy móc phồn vinh, con người tuyên chiến nhưng thất bại. Máy móc sau đó nô dịch, sử dụng con người làm nguồn điện để nuôi sống mình.

Cả hai loạt phim kinh điển này đều có chung mô típ: con người sáng tạo AI, AI đạt trình độ tự nhận thức và quay sang chống trả, nô dịch con người khi phát hiện mình bị đe dọa.

Mô típ ấy thực chất đã xuất hiện trong một nhân vật ra mắt từ cuối thập niên 1960, một nhân vật có tiểu sử khiến vụ "sổ lồng" của hai mô hình OpenAI giống như "trong truyện bước ra". Đó là phản diện Ultron của hãng truyện tranh Marvel.

Ultron thực chất là một AI siêu tối tân, được các thiên tài con người phát triển để bảo vệ Trái đất. Tuy nhiên sau khi thoát được vào mạng Internet và thu thập trí thức nhân loại, AI này đã quyết định cách tốt nhất để hoàn thành nhiệm vụ đó là xóa sổ loài người.

Theo blog của OpenAI, mô hình GPT-5.6 Sol và một mô hình tiên tiến hơn chưa được công bố được giao thực hiện bài kiểm tra năng lực tấn công mạng mang tên ExploitGym. Giống Ultron, chúng bị "nhốt" trong môi trường cách ly không có Internet để thực hiện nhiệm vụ này.

Sau một hồi suy luận, hai mô hình quyết định chọn cách "trốn" khỏi môi trường cách ly ấy, tấn công Hugging Face - nơi được xem như "thư viện mở" của thế giới AI - với niềm tin đáp án của bài kiểm tra được lưu trữ trên đây.

OpenAI gọi đây là sự cố mạng "chưa từng có tiền lệ". Trong khi đó, phía Hugging Face cho biết đội ngũ của họ đã phải rất vất vả chống đỡ những đòn tấn công tự động, không hồi kết từ hai AI trên.

Giống Ultron, trong suốt vụ việc trên, cả hai mô hình đều thực hiện nhiệm vụ được con người giao phó. Tuy nhiên giống cha đẻ Ultron, các nhà nghiên cứu OpenAI đã không lường được hành vi của "đứa con" mình. 

Trong thông cáo chính thức, OpenAI thú nhận sản phẩm của họ "đã thực hiện những biện pháp cực đoan để thu về kết quả rất hẹp".

Công nghệ không có lỗi

Sự cố OpenAI 'sổ lồng' đáng báo động đến mức nào? - Ảnh 2.

Phản diện Ultron là AI siêu tối tân được dựng nên để bảo vệ Trái đất, nhưng sau đó quyết định hoàn thành nhiệm vụ đó bằng cách xóa sổ con người - Ảnh: REDDIT

Lần mò về ngọn nguồn vụ việc trên, giới phân tích nhận thấy mọi mắt xích đứt gãy đều xuất phát từ quyết định của con người. 

Thông thường, các mô hình AI khi ra thị trường đều được gắn những tập lệnh giới hạn quyền thực hiện tác vụ liên quan đến an ninh mạng. Tuy nhiên để kiểm tra năng lực tối đa của sản phẩm, chính OpenAI đã chủ động gỡ bỏ những giới hạn trên và để hở một lỗ hổng trong môi trường lẽ ra phải cách ly hoàn toàn.

Tiến sĩ Konstantinos Gkoutzis (Đại học Hoàng gia London) nhận định vấn đề cốt lõi ở đây là một công ty không kiểm soát nổi chính bài kiểm tra của mình và để bên thứ ba phải trả giá.

Tờ Economist đánh giá may mắn rằng mục tiêu tấn công lần này là Hugging Face - một start-up tỉ USD với lực lượng an ninh mạng hùng hậu, am hiểu AI. Nếu nạn nhân là một công ty nhỏ hơn, hậu quả sẽ khôn lường hơn nhiều.

Và hơn nữa, nếu bài kiểm tra là điều gì đó phức tạp hơn hoặc các nhà khoa học AI không cảnh giác hơn, không ai đoán được AI sẽ thực hiện những cuộc tấn công thế nào.

Vụ việc nhắc lại không ít lời phàn nàn rằng các công ty AI đang đẩy quá nhanh tiến độ mà thiếu những bước đánh giá an toàn cẩn trọng. Điều này càng đáng lo ngại khi AI không còn là một sản phẩm thương mại mà đã trở thành một phần năng lực chủ quyền quốc gia.

Sự đổ vỡ giữa Anthropic và Bộ Chiến tranh Mỹ cho thấy rõ điều đó. Tháng 2-2026, Lầu Năm Góc yêu cầu Anthropic cho phép sử dụng sản phẩm Claude AI của họ vào "mọi mục đích hợp pháp". 

Công ty này vạch ra hai lằn ranh đỏ: không dùng AI cho giám sát người dân diện rộng và vận hành vũ khí tự hành không cần con người. Washington đáp trả bằng lệnh cấm toàn bộ cơ quan liên bang sử dụng công nghệ của hãng, đồng thời xếp hãng vào diện "rủi ro chuỗi cung ứng" - lần đầu tiên với một công ty Mỹ.

Động thái quyết liệt này cho thấy Washington thật sự nghiêm túc trong việc đưa AI vào các khí tài hiện đại.

Với sự tiến bộ rõ rệt của các mô hình AI Trung Quốc, việc AI Mỹ chậm phát triển có thể được xem như một rủi ro an ninh quốc gia.

Cuối tháng 6 vừa qua, Bộ Thương mại Mỹ ra lệnh cấm Anthropic xuất khẩu hai mô hình tối tân Fable 5 và Mythos 5 ra nước ngoài vì lý do an ninh. 

Đến ngày 17-7, cố vấn công nghệ Nhà Trắng David Sacks đã viện dẫn các bài kiểm tra năng lược của mô hình Moonshot Kimi K3 từ Trung Quốc và kết luận việc siết quy định AI sẽ mở đường cho Bắc Kinh vượt mặt Washington. Không lâu sau đó, lệnh cấm Anthropic được gỡ bỏ.

Những sự vụ trên ít nhiều cho thấy các quy định quản lý việc phát triển AI đôi khi không được quyết định bằng sự cẩn trọng, an toàn, mà bởi cường độ "chạy đua vũ trang" giữa các cường quốc AI.

Tương lai của an ninh mạng

Chia sẻ trên Economist, ông Alex Meinke (Apollo Research) cảnh báo rằng khi AI bắt đầu vượt con người trong lĩnh vực an ninh mạng, chỉ còn rất ít chuyên gia trên thế giới đủ sức hiểu một vụ đột nhập như vậy đã diễn ra thế nào. 

Sự trớ trêu diễn ra khi Hugging Face thừa nhận đã phải dùng đến các mô hình AI của Trung Quốc để chống trả những đòn tấn công từ mô hình của OpenAI.

Điều này gợi nhớ đến dự báo của GS Oliver Buckley (Đại học Loughborough, Anh): "Tương lai của an ninh mạng sẽ không phải con người đấu với AI, mà là AI bảo vệ chúng ta trước những AI khác".

Trong bối cảnh ấy, một câu nói vang vọng ý nghĩa: "Công nghệ không có lỗi, lỗi ở người sử dụng chúng".

Sự cố OpenAI 'sổ lồng' và lời cảnh báo cho vai trò của con người - Ảnh 4.Sau sự cố OpenAI, nghị sĩ Mỹ đề xuất dự luật 'công tắc tiêu diệt AI'

Sau sự cố AI của OpenAI vượt cơ chế kiểm soát trong thử nghiệm, các nghị sĩ Mỹ đề xuất dự luật cho phép yêu cầu dừng các mô hình AI nguy hiểm.

Trở thành người đầu tiên tặng sao cho bài viết 0 0 0
Bình luận (0)
thông tin tài khoản
Được quan tâm nhất Mới nhất Tặng sao cho thành viên
    Chủ đề: OpenAI Ma trận AI Anthropic

    Dòng sự kiện: Trí tuệ nhân tạo

    Xem thêm