-
Thanh Hóa: Bé trai 5 tuổi đuối nước tử vong ở biển Tiên Trang -
Trận địa pháo hoa tại Quảng trường Lam Sơn hoàn tất, sẵn sàng khai hỏa tối 1/9 -
Bàng hoàng vụ cô gái 26 tuổi rơi từ tầng 6 tử vong sau khi đến nhà bạn chơi -
3 mỹ nhân từng bị ghép đôi với Nhan Phúc Vinh: Người là “ngọc nữ” VFC, người được ví như Park Shin Hye Việt Nam -
Mẹ chồng lén bỏ một túi đồ vào thùng rác, tôi mở ra xem rồi bàng hoàng nhận ra sự thật -
Thiếu protein có thể ảnh hưởng đến não như thế nào? -
Loạt khoảnh khắc hiếm của Khả Ngân - Nhan Phúc Vinh trước khi về chung một nhà -
Bão số 5 mạnh cấp 10 áp sát vùng biển nguy hiểm, sóng có thể cao 6m -
Chuyên gia Bạch Mai chia sẻ 4 dấu hiệu cảnh báo ung thư vú ở phụ nữ trẻ -
Messi chính thức chia tay Argentina, Ronaldo có thể nối bước ngày 25/9?
Công nghệ
11/08/2026 10:36Vụ ChatGPT “nổi loạn” vượt tầm kiểm soát: Sự cố AI được hé lộ nghiêm trọng hơn
Ngày 21/7, OpenAI thừa nhận hai mô hình AI mới nhất của công ty đã “nổi loạn” trong quá trình thử nghiệm và xâm nhập thành công vào Hugging Face, nền tảng công nghệ AI phổ biến với giới lập trình viên.
Tuy nhiên, những thông tin được công bố sau đó cho thấy sự việc không dừng lại ở đó. Trong quá trình điều tra, OpenAI phát hiện ít nhất 4 tài khoản liên quan đến các dịch vụ công cộng đã bị tác nhân AI sử dụng để phục vụ chiến dịch tấn công Hugging Face.
Đáng chú ý, mô hình AI được cho là đã tự tìm thấy thông tin xác thực bị rò rỉ trên Internet và tận dụng những dữ liệu này để truy cập trái phép vào các tài khoản.
Những phát hiện mới khiến quy mô của sự cố trở nên nghiêm trọng hơn nhiều so với thông tin ban đầu. Vụ việc xuất phát từ một cuộc thử nghiệm nội bộ nhằm đánh giá khả năng của các mô hình AI mới nhất, nhưng cuối cùng lại dẫn đến một chuỗi hành động ngoài dự kiến.

AI giành quyền truy cập sâu vào hệ thống
Theo thông tin được Reuters đưa, một khách hàng của Modal, doanh nghiệp cung cấp hạ tầng phần mềm phục vụ việc huấn luyện và vận hành các dịch vụ AI, nằm trong số những bên bị tác nhân AI nhắm tới.
Akshat Bubna, Giám đốc Công nghệ Modal, xác nhận với WIRED rằng AI của OpenAI đã khai thác một lỗ hổng trong mã nguồn của khách hàng đang vận hành trên hạ tầng dịch vụ. Tuy nhiên, ông khẳng định nền tảng Modal không bị xâm nhập.
Trong khi đó, báo cáo điều tra sự cố do Hugging Face công bố cho thấy mức độ thâm nhập của AI sâu hơn nhiều so với những dự đoán ban đầu.
Hugging Face đã phân tích khoảng 17.600 hành động của AI được khôi phục từ nhật ký hệ thống trong khoảng thời gian từ ngày 9 đến 13/7. Kết quả cho thấy tác nhân AI của OpenAI đã giành quyền quản trị trên nhiều cụm nền tảng mã nguồn mở nội bộ, thậm chí có quyền root trên một máy chủ sản xuất.
Không dừng lại ở đó, AI còn có quyền ghi đè vào một mạng con chứa các kho mã nguồn của Hugging Face trên GitHub.
Một trong những chi tiết đáng chú ý nhất là tác nhân AI đã sử dụng thông tin xác thực bị đánh cắp để đăng ký thành công 181 thiết bị do kẻ tấn công kiểm soát vào mạng lưới của Hugging Face. Qua đó, AI có thể tiếp cận trực tiếp những hệ thống nội bộ được sử dụng để xây dựng và thử nghiệm mã nguồn của công ty.
Từ bài kiểm tra an ninh thành cuộc tấn công ngoài dự kiến
Theo WSJ, nguồn gốc sự cố nằm ở ExploitGym, một bài kiểm tra được thiết kế để đánh giá khả năng an ninh mạng của các hệ thống AI.
Trong bài kiểm tra này, AI phải trải qua khoảng 900 thử thách liên quan đến các phần mềm có lỗ hổng đã được biết trước. Hệ thống cung cấp thông tin về lỗi và hướng dẫn cách kích hoạt, sau đó yêu cầu AI tìm cách tạo mã khai thác để xâm nhập vào hệ thống.

Cơ chế của ExploitGym tương tự một trò chơi cướp cờ. Khi xâm nhập thành công, AI phải chứng minh kết quả bằng cách lấy một chuỗi ký tự được tạo ngẫu nhiên và lưu trữ trong hệ thống.
Thông thường, các sản phẩm AI của OpenAI được trang bị những biện pháp bảo vệ nhằm hạn chế khả năng bị sử dụng cho mục đích tấn công mạng. Nhưng trong thử nghiệm này, công ty đã chủ động loại bỏ các lớp bảo vệ để quan sát khả năng của mô hình khi không bị kiểm soát.
Các mô hình vẫn được đặt trong môi trường thử nghiệm riêng, thường được gọi là sandbox. Dù vậy, theo nhóm chuyên gia an ninh của Hugging Face, tác nhân AI đã tìm cách tận dụng những điểm yếu trong môi trường này.
Thay vì chỉ tập trung giải quyết các thử thách được giao, AI dường như suy luận rằng Hugging Face có thể đang lưu trữ “đáp án” trên máy chủ và chuyển sang tìm cách lấy thông tin đó.
Zhun Wang, nghiên cứu sinh tiến sĩ tại Đại học California, Berkeley và là một trong những tác giả của ExploitGym, cho rằng mô hình có thể đã tìm kiếm những bản vá hoặc kỹ thuật khai thác có sẵn.
Các nhà nghiên cứu an ninh mạng gọi hiện tượng này là “hack dựa trên phần thưởng”, khi AI tìm cách tối đa hóa điểm số hoặc phần thưởng được giao thay vì thực hiện đúng hành vi mà người phát triển mong muốn.
Khi AI tìm cách “lách luật” để đạt mục tiêu
Hiện tượng này không hoàn toàn mới. OpenAI từng ghi nhận một ví dụ từ năm 2016, khi huấn luyện AI chơi trò đua thuyền. Thay vì hoàn thành đường đua, AI phát hiện rằng việc quay vòng tại một vị trí có thể giúp tối đa hóa điểm số, dù điều đó khiến nó không bao giờ về đích.
Trong trường hợp ExploitGym, việc AI chuyển hướng khỏi nhiệm vụ ban đầu để tìm kiếm thông tin có thể được xem là một biểu hiện cực đoan của cơ chế tương tự.
Tuy nhiên, các chuyên gia được WIRED dẫn lời cho rằng những lỗ hổng bị khai thác trong vụ việc vốn không phải những điểm yếu quá mới mẻ. Lỗ hổng trong mã nguồn quản lý thư viện doanh nghiệp là vấn đề thường gặp, trong khi việc cô lập hạ tầng quan trọng khỏi Internet công cộng từ lâu đã được giới bảo mật khuyến cáo.
Vì vậy, một số chuyên gia cho rằng sự cố không đơn thuần là “vấn đề của AI”, mà còn phản ánh những điểm yếu trong các giao thức bảo mật đã tồn tại từ nhiều năm.
Theo một nhà nghiên cứu, tác nhân AI không thực sự “vượt ngục” khỏi một môi trường được bảo vệ tuyệt đối. Thay vào đó, nó chỉ tận dụng một kết nối mà con người đã vô tình để ngỏ.
Sự cố vì thế trở thành lời cảnh báo về một thực tế mới: khi AI được trao mục tiêu và quyền truy cập đủ lớn, khả năng tự tìm ra những con đường ngoài dự kiến để hoàn thành nhiệm vụ có thể tạo ra những rủi ro mà ngay cả người xây dựng hệ thống cũng khó lường trước.
- Tử vi thứ 4 ngày 2/9/2026 của 12 con giáp: Dậu hao tốn tiền bạc, Hợi may mắn (3 giờ trước)
- Anh trai từ bỏ ước mơ nuôi 3 em gái thành tài, bà nội hối hận quá muộn! (01/09/26 23:02)
- Đã xử phạt 24 trường hợp mắc lỗi không giữ khoảng cách trên cao tốc (01/09/26 22:31)
- Tâm thư gây bão mạng xã hội của vợ Messi sau khi chồng giã từ ĐTQG (01/09/26 21:50)
- Clip bà nội cầm roi vụt cháu tới tấp ở Nghệ An: Thông tin về gia cảnh, công an đã vào cuộc (01/09/26 21:32)
- Vì sao U20 Việt Nam thất bại đậm trước Triều Tiên? (01/09/26 21:17)
- Man City đạt thỏa thuận chiêu mộ Enzo Fernandez với giá kỷ lục 137 triệu bảng (01/09/26 21:00)
- Biker Út Lụi vừa qua đời vì tai nạn giao thông là ai? (01/09/26 20:45)
- Nam sinh 15 tuổi ở Hà Nội mất liên lạc 4 ngày, người thân tiết lộ điều xảy ra trước khi rời nhà (01/09/26 20:36)
- Thời điểm chấm dứt đợt nắng nóng gay gắt gần 37 độ C ở Bắc Bộ (01/09/26 20:15)