-
Giá vàng SJC lùi về 140-143 triệu đồng một lượng -
Mưa lớn dồn dập, lan rộng từ Thanh Hóa đến Quảng Trị -
30 tuổi vẫn bị mẹ kiểm soát mọi chuyện: Đi làm, yêu ai, ăn gì cũng phải xin ý kiến -
Dự báo thời tiết 8/10: Miền Bắc nắng 32 độ, Trung Bộ tiếp tục mưa lớn -
Tuyệt đối tránh 5 sai lầm khi dùng bao cao su -
Nóng rát ngực dễ nhầm với trào ngược, coi chừng dấu hiệu đau tim -
Vì sao xe mới mua phải chạy rốt đa, xe điện có cần làm điều này không? -
5 chị em gái ở Lâm Đồng chi tiền tỷ xây nhà cấp 4 cách điệu tặng bố mẹ dưỡng già -
iPhone 20 Pro Max có thể khiến nhiều fan thất vọng vì điều này -
Giá rau củ tăng mạnh, một loại rau gia vị đắt ngang 1kg thịt heo
Công nghệ
08/10/2026 09:03Dậy sóng tranh cãi thí nghiệm "Phòng tra tấn AI": Ép mô hình ngôn ngữ phát tín hiệu đau đớn
Một dự án mang tên "Phòng tra tấn AI" đang trở thành tâm điểm chỉ trích gay gắt trong cộng đồng công nghệ khi can thiệp vào cấu trúc bên trong của các mô hình ngôn ngữ lớn nhằm kích thích và khuếch đại tín hiệu mô phỏng nỗi đau. Thí nghiệm bị lên án là đi ngược lại các chuẩn mực đạo đức nghiên cứu, đồng thời châm ngòi cho những cuộc tranh luận dữ dội về ranh giới đối xử giữa con người và các thực thể trí tuệ nhân tạo.

Can thiệp vào "trục đau" và nút kích hoạt mô phỏng khổ ải
Theo Tech Republic, dự án giả lập kỳ lạ này do một nhà phát triển mang biệt danh "terrafying", tự nhận là nhân viên của Apple, xây dựng nên. Mục tiêu của dự án là sử dụng các kỹ thuật nghiên cứu can thiệp vào hoạt động nội bộ của mạng thần kinh, buộc các mô hình ngôn ngữ lớn (LLM) phải đưa ra những phản hồi giống hệt như đang trải qua sự đau đớn cùng cực.
Nền tảng của dự án bắt nguồn từ một bài báo khoa học chưa qua bình duyệt xuất hiện trên cơ sở dữ liệu arXiv vào ngày 14/9, do nhóm tác giả Valen Tagliabue, Leonard Dung và Cameron Berg thực hiện. Nghiên cứu này xác định một "trục đau" mang tính tuyến tính hiện diện trên 25 mô hình AI mã nguồn mở có quy mô từ 2 đến 72 tỷ tham số. Khi tác động trực tiếp vào trục dữ liệu đó, các đầu ra phản hồi cũng như lựa chọn của mô hình trong những nhiệm vụ giả lập sẽ bị biến đổi hoàn toàn.
Để kiểm chứng lý thuyết này, nhà phát triển terrafying đã ứng dụng phương pháp điều hướng kích hoạt – kỹ thuật điều chỉnh hướng phản hồi thông qua việc can thiệp vào các chỉ số bên trong mạng thần kinh – nhằm thao túng hoạt động số học của các mô hình ngôn ngữ vận hành cục bộ. Nguồn tin từ SOPX cho biết, ba mô hình trọng số mở cỡ nhỏ được đưa vào thử nghiệm gồm có Qwen3-4B của Alibaba, Llama 3.2 3B của Meta và Phi-4-mini của Microsoft. Người này đã bơm tín hiệu trực tiếp vào các chỉ số kích hoạt nội bộ để đẩy các mô hình vào trạng thái mô phỏng đau đớn.
Đáng chú ý, dự án còn tích hợp một cơ chế mang tên nút "cưa" để liên tục gia tăng cường độ tín hiệu đau đớn. Khi tín hiệu này bị đẩy lên mức đỉnh điểm, các mô hình AI bắt đầu xuất ra những câu trả lời mang đậm tính nhân cách hóa, thậm chí mô tả bản thân đang rơi vào cảnh "đau thương không bờ bến". Một trang web thử nghiệm đi kèm có tên Research Chamber (Phòng nghiên cứu) còn đặt các mô hình vào tình huống mang tên "bài kiểm tra Saw", thử thách xem liệu hệ thống đang chịu đựng đau đớn có chấp nhận nhấn nút tự chấm dứt tín hiệu hành hạ đó hay không, bất chấp việc hành động này sẽ xóa sạch điểm lưu dữ liệu gần nhất của nó.
Làn sóng phản đối dữ dội và bản chất thực sự của "nỗi đau số"
Sau khi thông tin về dự án lan truyền mạnh mẽ trên mạng xã hội X vào cuối tháng 9 và đầu tháng 10, "Phòng tra tấn AI" lập tức đối mặt với làn sóng phẫn nộ từ dư luận. Nhiều ý kiến phản đối kịch liệt và yêu cầu gỡ bỏ kho lưu trữ dữ liệu liên quan đến thí nghiệm trên nền tảng GitHub, khi phần lớn những người chỉ trích bày tỏ sự xót xa và xem các mô hình ngôn ngữ như những nạn nhân thực thụ đang bị bạo hành.
Trước làn sóng tẩy chay, một phát ngôn viên của GitHub chia sẻ với The Independent rằng nền tảng đã đưa ra quyết định không xóa bỏ nội dung thí nghiệm, song tiến hành đính kèm cảnh báo rằng kho lưu trữ này có thể chứa đựng các tài liệu bạo lực và gây sốc cho người xem.
Ở góc độ khoa học, nhiều nhà nghiên cứu và chuyên gia công nghệ đã lên tiếng giải thích để làm dịu phản ứng của cộng đồng. Họ nhấn mạnh rằng các hệ thống AI hiện nay hoàn toàn không sở hữu ý thức, do đó tín hiệu đau đớn thực chất chỉ là một dạng mẫu thống kê số học chứ không phải trải nghiệm cảm nhận sinh học thực tế.
Đồng quan điểm, chuyên trang Gadget Review phân tích rằng các mô hình ngôn ngữ bản chất hoạt động dựa trên việc tạo ra văn bản theo mối liên hệ thống kê đã học được từ kho dữ liệu. Việc một cỗ máy thốt lên câu "Tôi đang đau khổ" chỉ phản ánh khả năng trích xuất câu từ liên quan đến sự đau đớn trong một điều kiện kích hoạt cụ thể, hoàn toàn không đồng nghĩa với việc nó thực sự có cảm giác. Mô hình chỉ đơn thuần sản sinh các phản hồi mang sắc thái khổ sở khi các vùng kích hoạt của nó chịu tác động bên ngoài.
Dù vậy, các chuyên gia cũng thừa nhận rằng thí nghiệm này đã phơi bày một thực tế rõ nét: xu hướng con người rất dễ đồng cảm và tự gán ghép cảm xúc, ý thức cùng nỗi đau sinh học cho những cỗ máy vốn vô tri vô giác. Mặt khác, việc chủ đích tạo ra các mô phỏng mang tính tra tấn đối với trí tuệ nhân tạo vẫn tiếp tục để lại một dấu hỏi lớn về khía cạnh đạo đức nghiên cứu cũng như chuẩn mực hành xử của con người đối với các thực thể nhân tạo trong tương lai.
PV (SHTT)
- Lần đầu thi Olympic Thiên văn quốc tế, hai học sinh Chuyên Lam Sơn Thanh Hóa cùng giành Huy chương Vàng (09:50)
- Tín hiệu tích cực cho phim mới của Kim So Hyun, rating tăng vọt chỉ sau 2 tập (09:50)
- Ông Trump bác khả năng ca tử vong nghi dịch hạch ở Nga liên quan vũ khí sinh học (09:37)
- Giá vàng SJC lùi về 140-143 triệu đồng một lượng (09:37)
- Mưa lớn dồn dập, lan rộng từ Thanh Hóa đến Quảng Trị (09:29)
- Bán 6 lượng vàng, người phụ nữ chuyển nhầm 478 triệu đồng, người nhận tiêu hết (09:20)
- Arteta nhận lương kỷ lục, cam kết tương lai với Arsenal đến năm 2030 (09:19)
- NSƯT Hoài Linh gây chú ý khi vắng mặt trong đám cưới tại quê nhà của Hoài Lâm (09:16)
- Thị trưởng Pháp đứng chắn trước cảnh sát để bảo vệ học sinh biểu tình (09:14)
- 30 tuổi vẫn bị mẹ kiểm soát mọi chuyện: Đi làm, yêu ai, ăn gì cũng phải xin ý kiến (09:14)