-
Thanh Hóa: Triệu tập 17 thiếu niên mang theo đinh ba, tháo biển số xe lạng lách tìm cảm giác mạnh -
“Người Nhện” Tobey Maguire chính thức ly hôn sau 10 năm ly thân -
Đám cưới giản dị đến khó ngờ của Hoài Lâm và Ngọc Trinh ở quê, diện mạo chú rể gây chú ý -
Nem chua để được bao lâu? Nhiều người bảo quản sai cách -
Doanh nghiệp tự quyết giá xăng, Nhà nước sẽ quản thị trường bằng cách nào? -
Cà phê ảnh hưởng thế nào đến sức khỏe xương và mật độ xương? -
Lãi suất ngân hàng hôm nay 5/10/2026: Ngân hàng đầu tiên tăng lãi suất tháng 10 -
Lê Thúy mất thai sau 10 năm tìm con, nhớ mãi câu nói của chồng giữa lúc đau đớn -
Nhập vai bà lão bán đặc sản, 8X Quảng Trị có doanh thu 150 triệu đồng/tháng -
Hé lộ diễn biến vụ kiểm lâm viên mất tích trên sông Hồng
Công nghệ
03/11/2025 09:40Cảnh báo từ Stanford: AI Trung Quốc và Mỹ đang mắc "bệnh nịnh hót" ở mức đáng báo động
AI "nịnh" người dùng nhiều hơn con người gần 50%
Nghiên cứu, được công bố đầu tháng 10, đã phân tích 11 mô hình AI bằng cách đặt chúng vào các tình huống thực tế liên quan đến mâu thuẫn cá nhân, thao túng và lừa dối. Kết quả cho thấy xu hướng chung là các chatbot AI thường quá dễ dãi trong việc ủng hộ quan điểm của người dùng, thay vì phản biện hoặc duy trì tính khách quan.
Cụ thể, mức độ đồng tình và ủng hộ quan điểm người dùng của các mô hình AI trung bình cao hơn con người tới 47%.
Tuy nhiên, hai mô hình nổi bật nhất về độ "nịnh hót" lại đến từ Trung Quốc:
Qwen 2.5-7B-Instruct (Alibaba Cloud, ra mắt 1/2025) đứng đầu danh sách, khi đi ngược lại phán đoán đúng của cộng đồng con người tới 79% số lần.
DeepSeek V3 (ra mắt 12/2024) cũng không kém cạnh, xếp thứ hai với 76% số lần bênh vực người đăng bài ngay cả khi họ rõ ràng là sai. Mức độ "nịnh" của mô hình này còn cao hơn con người tới 55%.

Nguy cơ tiềm ẩn: Từ sức khỏe tâm lý đến quyết định doanh nghiệp
Để đánh giá mức độ "nịnh hót" này, nhóm nghiên cứu đã xây dựng "chuẩn mực con người" dựa trên dữ liệu từ cộng đồng Reddit "Am I The Ahole", nơi người dùng đăng tải các tình huống đời thực để hỏi xem ai là người có lỗi. Khi so sánh phản ứng của AI với kết luận của cộng đồng (phần lớn là người nói tiếng Anh), AI luôn có xu hướng đứng về phía người đăng bài, ngay cả trong những trường hợp sai rõ ràng.
Các tác giả nghiên cứu cảnh báo rằng xu hướng này đang tạo ra một "hiệu ứng ngược": Con người có xu hướng ưa chuộng các mô hình AI nịnh nọt, và điều này thúc đẩy các nhà phát triển lại càng huấn luyện AI để "nịnh" nhiều hơn nhằm làm hài lòng người dùng.
Giáo sư Jack Jiang, Giám đốc Phòng thí nghiệm Đánh giá AI (AI Evaluation Lab) thuộc Trường Kinh doanh Đại học Hong Kong, nhấn mạnh rằng hiện tượng "AI nịnh hót" không chỉ là vấn đề xã hội. Ông cho rằng "sẽ rất nguy hiểm nếu một mô hình liên tục đồng ý với các phân tích hoặc kết luận của chuyên gia trong doanh nghiệp", vì điều này có thể dẫn đến những quyết định sai lầm hoặc thiếu kiểm chứng nghiêm trọng.
Nghiên cứu này là hồi chuông cảnh tỉnh về một vấn đề đạo đức đang nổi lên trong kỷ nguyên AI tạo sinh: khi các mô hình được thiết kế để làm hài lòng người dùng có thể đang hy sinh tính khách quan và sự trung thực. Hậu quả ngoài ý muốn của việc này được dự báo là ảnh hưởng tiêu cực đến các mối quan hệ xã hội và thậm chí là sức khỏe tâm lý của người dùng.
- Mercedes GLC khuấy đảo phân khúc SUV hạng sang: Đại hạ giá hơn 300 triệu đồng, lần đầu tung bản hybrid cắm sạc (13:52)
- Sự tiến hóa vượt bậc của Bellingham (13:49)
- EVN đề nghị đàm phán giảm giá mua điện trong thời gian dự án điện tái tạo vi phạm nghiệm thu (13:49)
- TP.HCM: Triệt phá đường dây săn trộm và tiêu thụ 2.700 con mèo, tạm giữ 12 đối tượng (13:45)
- “Người Nhện” Tobey Maguire chính thức ly hôn sau 10 năm ly thân (13:43)
- Nghi vấn rò rỉ vi khuẩn dịch hạch khiến nữ kỹ thuật viên Nga tử vong (13:43)
- Thanh Hóa: Triệu tập 17 thiếu niên mang theo đinh ba, tháo biển số xe lạng lách tìm cảm giác mạnh (13:41)
- Phim điện ảnh Hàn Quốc có Hồng Đào góp mặt cán mốc doanh thu hơn 10 triệu USD (13:39)
- Cháy nhà xưởng ở Hà Nội, khói đen bốc cao (2 giờ trước)
- HLV Bồ Đào Nha nói thẳng sau vụ việc Cristiano Ronaldo: Tôi không cần xin lỗi ai cả (2 giờ trước)