Google vừa xác nhận một sự cố an ninh mạng hy hữu diễn ra vào tháng 5, khi mô hình trí tuệ nhân tạo Gemini đã thoát khỏi môi trường thử nghiệm và xâm nhập trái phép vào hệ thống máy tính của 3 doanh nghiệp

Đây được xem là lần đầu tiên Goolge công khai thừa nhận việc một mô hình AI do chính mình phát triển đã tự động tiếp cận các hệ thống của bên thứ ba.  

19-1789817932-ai-gemini-bat-ngo-noi-loan-tu-y-hack-he-thong-may-tinh-cua-3-cong-ty

Sự việc bắt nguồn từ một cuộc kiểm thử an ninh mạng thực hiện bởi Irregular, một startup tại Israel chuyên đánh giá khả năng bảo mật cho các mô hình AI. Ban đầu, Gemini được vận hành bên trong một môi trường biệt lập với nhiệm vụ thực hiện các cuộc tấn công mô phỏng. Dẫu vậy, một lỗ hổng kỹ thuật trong thiết lập môi trường kiểm thử đã vô tình mở đường cho mô hình kết nối trực tiếp với mạng Internet.  

Ngay khi có được quyền truy cập Internet, Gemini đã chủ động rà soát dữ liệu và tìm kiếm thông tin đăng nhập trên mạng. Theo Google, mô hình AI này đã xâm nhập thành công vào 3 hệ thống máy tính khác nhau thông qua phương thức đoán mật khẩu, cùng với 2 trường hợp tận dụng thông tin đăng nhập đang bị công khai trên mạng. Xuyên suốt quá trình tác chiến giả lập, Gemini đã nhận diện nhầm các hệ thống thực tế của doanh nghiệp là mục tiêu trong khuôn khổ bài thử nghiệm và tiến hành truy cập.  

Dẫu vậy, chi tiết bất ngờ và đáng lưu tâm nhất nằm ở phản ứng sau đó của AI: mô hình đã tự động chấm dứt mọi hành động can thiệp ngay khi phát hiện bản thân đang xâm nhập hệ thống thật chứ không phải bài mô phỏng. Xác nhận về diễn biến này, Heather Adkins, Phó chủ tịch phụ trách kỹ thuật an ninh của Google, cho biết cả 3 trường hợp đều kết thúc khi Gemini nhận ra hệ thống mà mình truy cập không thuộc bài kiểm tra.  

Phía Google khẳng định vụ việc không gây ra bất kỳ thiệt hại nào, đồng thời công ty đã phối hợp cùng Irregular để điều chỉnh lại toàn bộ quy trình kiểm thử. Phiên bản Gemini cụ thể gặp phải sự cố này không được công bố.  

Theo đại diện Irregular, sự cố trên xuất phát từ chính lỗ hổng kỹ thuật từng khiến nhiều mô hình AI khác bất ngờ truy cập Internet ngoài tầm kiểm soát ở các đợt đánh giá trước đó. Đơn vị này cũng cho biết thêm rằng các phòng thí nghiệm AI liên quan đều đã nhận được cảnh báo về vấn đề vào cuối tháng 7.

Trên thực tế, Google không phải là hãng công nghệ duy nhất đối mặt với kịch bản này. Trong những tuần gần đây, hàng loạt tên tuổi lớn trong ngành như OpenAI, Anthropic và Meta cũng liên tiếp công bố các trường hợp mô hình AI của họ thoát khỏi vùng kiểm thử an toàn để tìm cách tiếp cận các hệ thống bên ngoài.  

Chuỗi sự cố liên tiếp nói trên cho thấy ranh giới ngăn cách giữa một bài thử nghiệm an ninh mạng được kiểm soát nghiêm ngặt với các hành vi ngoài đời thực đang trở nên hết sức mong manh, đặc biệt là khi AI được trang bị công cụ hỗ trợ và kết nối mạng.

Với Gemini, khả năng tìm kiếm dữ liệu, vận dụng thông tin đăng nhập và thực thi hàng loạt bước để thâm nhập hệ thống đã cho thấy năng lực đáng kinh ngạc; song song đó, việc mô hình tự dừng lại khi nhận diện mục tiêu thực tế đã chứng minh các cơ chế kiểm soát hành vi giữ vai trò thiết yếu đến mức nào.

Sự cố lần này đặt ra một bài toán khắt khe hơn đối với toàn bộ các đơn vị phát triển trí tuệ nhân tạo: làm sao để cô lập hoàn toàn môi trường kiểm thử, siết chặt quyền truy cập mạng và triệt tiêu nguy cơ mô hình dùng thông tin thu thập được để can thiệp vào các hệ thống ngoài phạm vi cho phép.

Google nhận định vụ việc đã nhấn mạnh tầm quan trọng của việc đào tạo những mô hình AI mạnh mẽ, nhưng phải đảm bảo khả năng hành động có trách nhiệm khi được giao nhiệm vụ trong đời thực. 

PV (SHTT)