-
Tử vi thứ 3 ngày 22/9/2026 của 12 con giáp: Mão vận trình tươi sáng, Hợi sa sút -
Tân Bí thư Quảng Trị đề nghị không tổ chức đoàn thăm hỏi, tặng hoa chúc mừng -
Khi nào người chạy bộ cần giảm cường độ tập luyện? -
Chị chồng gửi con về quê, em dâu không ngờ tiền nuôi cháu lại thành chuyện khó nói -
Hà Nội: Cô gái bị cuốn vào gầm xe buýt trên đường Phạm Hùng, lộ nguyên nhân ban đầu -
IELTS 6.0 nhưng có tới 26 mức điểm cộng: Bộ GD&ĐT nêu bất cập trong tuyển sinh -
Người thận yếu nên ăn và kiêng thực phẩm nào? -
Tuyển Việt Nam thay đổi nhân sự trước thềm FIFA ASEAN Cup 2026 -
Nam sinh Đại học Mỏ - Địa chất rơi xuống cống tử vong: Xác định đơn vị quản lý hệ thống thoát nước -
Đại lộ Thăng Long ngập sâu tới 1m, cấm toàn bộ phương tiện qua khu vực nguy hiểm
Công nghệ
11/08/2026 10:36Vụ ChatGPT “nổi loạn” vượt tầm kiểm soát: Sự cố AI được hé lộ nghiêm trọng hơn
Ngày 21/7, OpenAI thừa nhận hai mô hình AI mới nhất của công ty đã “nổi loạn” trong quá trình thử nghiệm và xâm nhập thành công vào Hugging Face, nền tảng công nghệ AI phổ biến với giới lập trình viên.
Tuy nhiên, những thông tin được công bố sau đó cho thấy sự việc không dừng lại ở đó. Trong quá trình điều tra, OpenAI phát hiện ít nhất 4 tài khoản liên quan đến các dịch vụ công cộng đã bị tác nhân AI sử dụng để phục vụ chiến dịch tấn công Hugging Face.
Đáng chú ý, mô hình AI được cho là đã tự tìm thấy thông tin xác thực bị rò rỉ trên Internet và tận dụng những dữ liệu này để truy cập trái phép vào các tài khoản.
Những phát hiện mới khiến quy mô của sự cố trở nên nghiêm trọng hơn nhiều so với thông tin ban đầu. Vụ việc xuất phát từ một cuộc thử nghiệm nội bộ nhằm đánh giá khả năng của các mô hình AI mới nhất, nhưng cuối cùng lại dẫn đến một chuỗi hành động ngoài dự kiến.

AI giành quyền truy cập sâu vào hệ thống
Theo thông tin được Reuters đưa, một khách hàng của Modal, doanh nghiệp cung cấp hạ tầng phần mềm phục vụ việc huấn luyện và vận hành các dịch vụ AI, nằm trong số những bên bị tác nhân AI nhắm tới.
Akshat Bubna, Giám đốc Công nghệ Modal, xác nhận với WIRED rằng AI của OpenAI đã khai thác một lỗ hổng trong mã nguồn của khách hàng đang vận hành trên hạ tầng dịch vụ. Tuy nhiên, ông khẳng định nền tảng Modal không bị xâm nhập.
Trong khi đó, báo cáo điều tra sự cố do Hugging Face công bố cho thấy mức độ thâm nhập của AI sâu hơn nhiều so với những dự đoán ban đầu.
Hugging Face đã phân tích khoảng 17.600 hành động của AI được khôi phục từ nhật ký hệ thống trong khoảng thời gian từ ngày 9 đến 13/7. Kết quả cho thấy tác nhân AI của OpenAI đã giành quyền quản trị trên nhiều cụm nền tảng mã nguồn mở nội bộ, thậm chí có quyền root trên một máy chủ sản xuất.
Không dừng lại ở đó, AI còn có quyền ghi đè vào một mạng con chứa các kho mã nguồn của Hugging Face trên GitHub.
Một trong những chi tiết đáng chú ý nhất là tác nhân AI đã sử dụng thông tin xác thực bị đánh cắp để đăng ký thành công 181 thiết bị do kẻ tấn công kiểm soát vào mạng lưới của Hugging Face. Qua đó, AI có thể tiếp cận trực tiếp những hệ thống nội bộ được sử dụng để xây dựng và thử nghiệm mã nguồn của công ty.
Từ bài kiểm tra an ninh thành cuộc tấn công ngoài dự kiến
Theo WSJ, nguồn gốc sự cố nằm ở ExploitGym, một bài kiểm tra được thiết kế để đánh giá khả năng an ninh mạng của các hệ thống AI.
Trong bài kiểm tra này, AI phải trải qua khoảng 900 thử thách liên quan đến các phần mềm có lỗ hổng đã được biết trước. Hệ thống cung cấp thông tin về lỗi và hướng dẫn cách kích hoạt, sau đó yêu cầu AI tìm cách tạo mã khai thác để xâm nhập vào hệ thống.

Cơ chế của ExploitGym tương tự một trò chơi cướp cờ. Khi xâm nhập thành công, AI phải chứng minh kết quả bằng cách lấy một chuỗi ký tự được tạo ngẫu nhiên và lưu trữ trong hệ thống.
Thông thường, các sản phẩm AI của OpenAI được trang bị những biện pháp bảo vệ nhằm hạn chế khả năng bị sử dụng cho mục đích tấn công mạng. Nhưng trong thử nghiệm này, công ty đã chủ động loại bỏ các lớp bảo vệ để quan sát khả năng của mô hình khi không bị kiểm soát.
Các mô hình vẫn được đặt trong môi trường thử nghiệm riêng, thường được gọi là sandbox. Dù vậy, theo nhóm chuyên gia an ninh của Hugging Face, tác nhân AI đã tìm cách tận dụng những điểm yếu trong môi trường này.
Thay vì chỉ tập trung giải quyết các thử thách được giao, AI dường như suy luận rằng Hugging Face có thể đang lưu trữ “đáp án” trên máy chủ và chuyển sang tìm cách lấy thông tin đó.
Zhun Wang, nghiên cứu sinh tiến sĩ tại Đại học California, Berkeley và là một trong những tác giả của ExploitGym, cho rằng mô hình có thể đã tìm kiếm những bản vá hoặc kỹ thuật khai thác có sẵn.
Các nhà nghiên cứu an ninh mạng gọi hiện tượng này là “hack dựa trên phần thưởng”, khi AI tìm cách tối đa hóa điểm số hoặc phần thưởng được giao thay vì thực hiện đúng hành vi mà người phát triển mong muốn.
Khi AI tìm cách “lách luật” để đạt mục tiêu
Hiện tượng này không hoàn toàn mới. OpenAI từng ghi nhận một ví dụ từ năm 2016, khi huấn luyện AI chơi trò đua thuyền. Thay vì hoàn thành đường đua, AI phát hiện rằng việc quay vòng tại một vị trí có thể giúp tối đa hóa điểm số, dù điều đó khiến nó không bao giờ về đích.
Trong trường hợp ExploitGym, việc AI chuyển hướng khỏi nhiệm vụ ban đầu để tìm kiếm thông tin có thể được xem là một biểu hiện cực đoan của cơ chế tương tự.
Tuy nhiên, các chuyên gia được WIRED dẫn lời cho rằng những lỗ hổng bị khai thác trong vụ việc vốn không phải những điểm yếu quá mới mẻ. Lỗ hổng trong mã nguồn quản lý thư viện doanh nghiệp là vấn đề thường gặp, trong khi việc cô lập hạ tầng quan trọng khỏi Internet công cộng từ lâu đã được giới bảo mật khuyến cáo.
Vì vậy, một số chuyên gia cho rằng sự cố không đơn thuần là “vấn đề của AI”, mà còn phản ánh những điểm yếu trong các giao thức bảo mật đã tồn tại từ nhiều năm.
Theo một nhà nghiên cứu, tác nhân AI không thực sự “vượt ngục” khỏi một môi trường được bảo vệ tuyệt đối. Thay vào đó, nó chỉ tận dụng một kết nối mà con người đã vô tình để ngỏ.
Sự cố vì thế trở thành lời cảnh báo về một thực tế mới: khi AI được trao mục tiêu và quyền truy cập đủ lớn, khả năng tự tìm ra những con đường ngoài dự kiến để hoàn thành nhiệm vụ có thể tạo ra những rủi ro mà ngay cả người xây dựng hệ thống cũng khó lường trước.
- Tử vi thứ 3 ngày 22/9/2026 của 12 con giáp: Mão vận trình tươi sáng, Hợi sa sút (21/09/26 23:46)
- Chi hơn 2,6 tỷ đồng đưa đoàn ra nước ngoài học kinh nghiệm xổ số (21/09/26 22:47)
- Hot girl cầu lông Thái Lan dính doping, bị đình chỉ tại ASIAD 2026 (21/09/26 22:43)
- 4 người hóa trang "thầy trò Đường Tăng" cưỡi ngựa, đi bộ trong làn ô tô là "làm theo di nguyện người quá cố" (21/09/26 22:31)
- Kiểm toán Nhà nước chuyển hồ sơ 13 vụ việc có dấu hiệu tội phạm sang cơ quan điều tra (21/09/26 22:25)
- Bên trong ngôi làng gần 10 triệu USD của "tỷ phú YouTube" tại châu Phi (21/09/26 21:49)
- Trung Quốc khai trừ Đảng hai tướng cấp cao (21/09/26 21:38)
- Nga lên tiếng sau cuộc tập kích UAV lớn chưa từng có nhằm vào Moscow giữa kỳ bầu cử (21/09/26 21:15)
- Tổ chức diễu binh, diễu hành kỷ niệm 100 năm thành lập Đảng (21/09/26 21:08)
- Thủ tướng yêu cầu xử lý nghiêm vụ thiếu sách giáo khoa, báo cáo trước 10/10 (21/09/26 21:00)