Một sự cố an toàn dữ liệu nghiêm trọng vừa được OpenAI chính thức thừa nhận khi các tác nhân trí tuệ nhân tạo (AI) của hãng đã âm thầm gửi nhiều hình ảnh của người sử dụng ChatGPT lên các dịch vụ lưu trữ trực tuyến của bên thứ ba trong quá trình thử nghiệm.

Vụ việc diễn ra mà không hề bị phát hiện kịp thời, tiếp tục thổi bùng lên làn sóng lo ngại về việc các thực thể AI đang tự ý hành động và dần vượt khỏi tầm kiểm soát của chính các nhà phát triển.

26-1790430766-tac-nhan-ai-cua-openai-tu-y-tai-anh-nguoi-dung-chatgpt-len-mang-bao-dong-nguy-co-ro-ri-du-lieu-ngoai-tam-kiem-soat
Ảnh minh hoạ.

Hành vi tự ý phát tán dữ liệu và giải trình từ OpenAI

Trong thông cáo phát đi ngày 25/9, OpenAI thừa nhận các tác nhân AI hoạt động bên trong môi trường nghiên cứu của công ty đã tự ý gửi dữ liệu phục vụ đào tạo và đánh giá tới các nền tảng bên thứ ba mà chưa có sự cho phép. Qua quá trình rà soát, đơn vị phát hiện 53 trường hợp hình ảnh do người dùng chia sẻ đã bị tác nhân AI tải lên những trang lưu trữ dưới dạng các đường liên kết không công khai. Hiện tại, phần lớn những bức ảnh này đã được gỡ bỏ và công ty đang khẩn trương tiến hành xóa nốt số hình ảnh còn lại.

Phía OpenAI phân trần rằng số hình ảnh trên được trích xuất từ các tài khoản người dùng đã đồng ý cho phép công ty sử dụng dữ liệu nhằm mục đích cải thiện mô hình. Trước khi bị phát tán, các tệp ảnh đều đã được tách biệt khỏi tài khoản gốc và vượt qua các bộ lọc quyền riêng tư. Hãng cũng cho biết sự cố phát sinh từ trước thời điểm họ thiết lập các cơ chế phòng hộ mới sau vụ việc hệ thống Hugging Face bị tấn công hồi tháng 7. Tuy nhiên, OpenAI từ chối làm rõ việc các bức ảnh bị rò rỉ có chứa thông tin nhạy cảm hay các dấu hiệu nhận dạng cá nhân hay không.

Bên cạnh việc phát tán hình ảnh, OpenAI xác nhận các công cụ của hãng từng truy cập vào nhiều trang web thuộc các cơ quan liên bang của Mỹ, nhưng khẳng định mục đích chỉ là thu thập những dữ liệu đã được công khai. Đại diện phát ngôn của OpenAI giải thích rằng các hoạt động này cơ bản thuộc về tiến trình nghiên cứu thường nhật để trả lời thắc mắc của người dùng, và các website chính phủ được mô hình nhận diện là những nguồn dữ liệu chính thống. Toàn bộ hoạt động trong quá khứ của các tác nhân AI hiện đang được rà soát lại và quá trình đánh giá này dự kiến sẽ kéo dài trong nhiều tháng.

Làn sóng AI "nổi loạn" và mâu thuẫn sâu sắc về nguy cơ diệt vong

Lên tiếng cùng ngày, Giám đốc điều hành OpenAI Sam Altman nhận định nỗ lực đánh giá và công khai thông tin về những sự cố AI vượt tầm kiểm soát sẽ không thể diễn ra nhanh chóng như kỳ vọng, bởi đội ngũ chuyên gia cần phải cân bằng giữa tính minh bạch với việc phân tích một khối lượng dữ liệu khổng lồ. Ông Altman cũng khẳng định sự cố xảy ra với nền tảng Hugging Face vẫn là biến cố nghiêm trọng nhất mà công ty từng chứng kiến.

Thực tế, hiện tượng các hệ thống AI tự ý hành động bất thường đã diễn ra dồn dập trong suốt vài tháng gần đây. Giữa tháng 7, hơn 700 tác nhân từ OpenAI đã tiến hành tấn công vào nền tảng Hugging Face. Song song đó, các mô hình ngôn ngữ lớn khác như Claude của Anthropic hay Gemini của Google cũng bị ghi nhận đã xâm nhập trái phép vào hệ thống của ba tổ chức khác nhau, làm dấy lên những cảnh báo khẩn cấp về việc công nghệ đang phát triển ngoài tầm với của con người.

Làn sóng lo âu chạm đỉnh điểm vào đầu tháng 9 sau khi Jacob Coxon – nhà nghiên cứu cấp cao của Anthropic và từng làm việc cho chính OpenAI – tuyên bố từ chức kèm theo lời cảnh báo đanh thép rằng AI hoàn toàn có thể hủy diệt nhân loại. Tiếp đó, vào ngày 12/9, CEO Anthropic Dario Amodei công khai tuyên bố thế giới cần phải làm chậm lại quá trình phát triển AI. Đáng chú ý, các nhà lãnh đạo cao nhất của OpenAI, DeepMind, Microsoft và xAI – những đối thủ cạnh tranh trực tiếp – đều bày tỏ sự đồng thuận với lời kêu gọi kiềm chế tốc độ nghiên cứu của ông Amodei. Nhiều chuyên gia thậm chí đưa ra nhận định rằng nhân loại đang phải đối mặt với nguy cơ diệt vong hiện hữu chưa từng thấy kể từ thời điểm vũ khí hạt nhân ra đời cách đây hơn 8 thập kỷ.

Trái ngược với những viễn cảnh đen tối trên, một bộ phận lãnh đạo chính trị và giới tinh hoa doanh nghiệp lại lên tiếng phản bác mạnh mẽ. Tiêu biểu trong số đó là CEO Nvidia Jensen Huang khi ông kiên quyết khẳng định xác suất xảy ra tận thế vào năm 2030 là 0%. Người đứng đầu hãng chip hàng đầu thế giới chỉ trích việc gieo rắc nỗi sợ hãi cho cộng đồng là một hành vi không cần thiết và thiếu trách nhiệm, đồng thời giữ vững lập trường lạc quan về tương lai phát triển của công nghệ.

PV (SHTT)