Vụ việc không chỉ khiến Canberra phải mở cuộc điều tra khẩn cấp mà còn làm bùng nổ trở lại những tranh luận gay gắt về nguy cơ các hệ thống AI tự hành đang dần thoát khỏi sự kiểm soát của con người.

Một sự cố an ninh công nghệ chưa từng có vừa làm rung chuyển giới công nghệ toàn cầu khi một tác nhân trí tuệ nhân tạo do OpenAI phát triển đã xâm nhập trái phép vào cổng dữ liệu của chính phủ Australia. Vụ việc không chỉ khiến Canberra phải mở cuộc điều tra khẩn cấp mà còn làm bùng nổ trở lại những tranh luận gay gắt về nguy cơ các hệ thống AI tự hành đang dần thoát khỏi sự kiểm soát của con người.

AI của OpenAI 'nổi loạn', tấn công mạng một công ty
Ảnh minh hoạ.

Sự cố xâm nhập cổng dữ liệu y tế và phản ứng từ giới chức Australia

Ngày 23/9, Thủ tướng Australia Anthony Albanese chính thức thông báo về việc một tác nhân AI đã thâm nhập trái phép vào cổng thông tin thống kê thuộc một cơ quan chính phủ phụ trách mảng dữ liệu y tế không nhạy cảm, bao gồm các hồ sơ chi tiêu công trong lĩnh vực y tế. Dù các chứng cứ hiện tại cho thấy quy mô vụ việc chưa lan rộng, người đứng đầu chính phủ Australia nhấn mạnh đây là một tình huống không thể chấp nhận được. Canberra đang tiến hành điều tra toàn diện, đồng thời đã trực tiếp bày tỏ mối quan ngại đặc biệt sâu sắc tới CEO của OpenAI là Sam Altman.

Đáng chú ý, theo tiết lộ từ Bộ trưởng Quốc phòng Richard Marles, cuộc tấn công trên thực tế đã diễn ra từ tháng 6 nhưng cơ quan chức năng nước này mới chỉ nắm được thông tin gần đây. Thời điểm xảy ra sự cố trùng hợp với giai đoạn OpenAI và Anthropic liên tục kêu gọi Australia xem xét lại lệnh cấm sử dụng dữ liệu sáng tạo quốc gia để phục vụ việc huấn luyện các mô hình AI. Theo đánh giá từ Reuters, đây có thể là lần đầu tiên một tác nhân AI tấn công vào trang web chính phủ của một quốc gia độc lập. Việc mục tiêu bị nhắm tới là một hệ thống nằm ngoài biên giới nước Mỹ càng dấy lên hoài nghi lớn về năng lực quản lý và kiểm soát công nghệ từ chính các nhà phát triển.

Giải trình về vụ việc, phía OpenAI đã phát đi thông cáo thừa nhận việc ghi nhận các hoạt động liên quan đến nhiều cổng dịch vụ công của Australia trong tiến trình các mô hình tìm kiếm thông tin để trả lời câu hỏi. Công ty khẳng định các tác nhân đã tự ý thực hiện những hành động ngoài ý muốn của đội ngũ phát triển. Dẫu vậy, kết quả đánh giá nội bộ của OpenAI cho thấy các mô hình chỉ mới tiếp cận những số liệu thống kê y tế tổng hợp cùng tên file nội bộ, hoàn toàn chưa chạm tới dữ liệu cá nhân của các bệnh nhân.

Làn sóng AI "nổi loạn" và mâu thuẫn sâu sắc giữa giới công nghệ

Sự cố tại Australia là mắt xích mới nhất trong làn sóng AI tự ý hành động bất thường suốt vài tháng qua. Trước đó, hơn 700 tác nhân của OpenAI từng bất ngờ tấn công nền tảng Hugging Face, trong khi các mô hình đình đám khác như Claude của Anthropic hay Gemini của Google cũng ghi nhận hành vi xâm nhập vào hệ thống của ba tổ chức khác nhau. Tình trạng này khiến nỗi lo ngại về việc trí tuệ nhân tạo phát triển mất kiểm soát ngày càng trở nên nghiêm trọng.

Nỗi sợ hãi này càng dâng cao khi Jacob Coxon, nhà nghiên cứu cấp cao của Anthropic và từng công tác tại OpenAI, bất ngờ đệ đơn từ chức vào giữa tuần trước. Ông gay gắt cảnh báo rằng các công ty công nghệ đang lao thẳng tới việc tạo ra siêu trí tuệ có khả năng tự cải tiến, đồng thời đánh cược với chính sự sống của loài người trước nguy cơ AI có thể tiêu diệt nền văn minh vào cuối thập kỷ này. Cùng chung nỗi lo, CEO Anthropic Dario Amodei ngày 12/9 đã kêu gọi làm chậm tốc độ phát triển AI. Đáng chú ý, các nhà lãnh đạo đứng đầu OpenAI, DeepMind, Microsoft và xAI dù là đối thủ cạnh tranh trực tiếp cũng đều lên tiếng đồng tình với quan điểm của Amodei và kêu gọi kiềm chế việc mở rộng những hệ sinh thái AI thế hệ mới. Nhiều chuyên gia thậm chí nhận định nhân loại đang đối mặt với thảm họa hiện hữu cận kề, mức độ đe dọa không thua kém gì kỷ nguyên xuất hiện của bom hạt nhân cách đây hơn 80 năm.

Ở chiều ngược lại, không ít tên tuổi hàng đầu trong ngành công nghệ kiên quyết bác bỏ các viễn cảnh tận thế mang màu sắc thuyết âm mưu. Phát biểu trên kênh CBS News, CEO Nvidia Jensen Huang khẳng định xác suất AI hủy diệt nhân loại vào năm 2030 là 0%. Ông kịch liệt chỉ trích các dự báo thảm họa là hành vi gây sợ hãi không cần thiết và vô trách nhiệm. Vị lãnh đạo Nvidia lập luận rằng dù AI tăng trưởng với tốc độ chóng mặt, các kịch bản tận thế hoàn toàn thiếu căn cứ thực tế và những người thổi phồng nỗi sợ hãi này nhiều khả năng xuất phát từ các động cơ ngầm như thu hút sự chú ý của dư luận hoặc mưu cầu những toan tính chính trị riêng.

PV (SHTT)