-
Trường Giang - Nhã Phương sau gần 1 tháng ồn ào: Người im ắng, người vẫn xuất hiện -
Bộ Công an thông báo về đối tượng khủng bố Nguyễn Văn Đài -
Ô tô tiếp tục đua giảm giá trong tháng 10, nhiều xe rẻ hơn cả trăm triệu đồng -
Hai nhóm học sinh lớp 8 mang dao phay hẹn đánh nhau ở Hà Tĩnh -
Hiệu trưởng lên tiếng về khoản phí giữ xe 80.000 đồng bị cho là thu cả phụ huynh đi bộ -
Nam diễn viên Trại Buôn Người được vinh danh, trở thành Ủy viên Trung ương Hội LHTN Việt Nam -
Giá xăng tiếp tục tăng, xăng E10 lên hơn 28.200 đồng/lít -
31 năm chờ đợi, người mẹ chết lặng khi cuộc hành quyết kẻ giết con thất bại -
Đàm Vĩnh Hưng lần đầu nói về những đồn đoán quanh mối quan hệ với Hoài Lâm -
TikTok bị tố đánh lừa người dùng bằng loạt "tính năng an toàn giả"
Công nghệ
16/09/2026 10:54OpenAI lộ "góc khuất": Thuê hàng trăm nhân sự đọc hội thoại của người dùng ChatGPT
Một cuộc điều tra mới đây từ chuyên trang 404 Media đã hé lộ về chiến dịch bí mật mang tên Project Lily, nơi OpenAI chiêu mộ hàng trăm người chỉ để đọc và chấm điểm các cuộc hội thoại thực tế của người dùng ChatGPT, làm dấy lên những lo ngại sâu sắc về vấn đề bảo mật thông tin cá nhân.

Dự án Project Lily và nỗ lực "gọt giũa" hành vi của trí tuệ nhân tạo
Theo phát hiện của 404 Media, OpenAI đang vận hành dự án kiểm duyệt nội bộ Project Lily với mục tiêu chính là nâng cao chất lượng phản hồi từ mô hình. Để phục vụ chiến dịch này, công ty sẵn sàng chi trả mức thù lao hơn 50 USD mỗi giờ cho các nhân viên đánh giá. Nhiệm vụ thường nhật của lực lượng này là đọc trực tiếp các đoạn hội thoại thực tế giữa người dùng với ChatGPT để tiến hành cho điểm mức độ hoàn thiện của câu trả lời.
Hệ thống tiêu chí đánh giá được xây dựng nhằm loại bỏ lối diễn đạt máy móc, cắt giảm các biểu tượng cảm xúc dư thừa hoặc thái độ nịnh nọt thái quá của trợ lý ảo. Đội ngũ kiểm duyệt cũng phải bảo đảm rằng ChatGPT không tự xưng "tôi" theo xu hướng nhân hóa như một con người thực thụ. Tiết lộ từ một nhân sự tham gia dự án cho biết công việc mang tính lặp đi lặp lại rất cao, song bộ quy tắc hướng dẫn lại thường xuyên bị thay đổi đột ngột, thậm chí tồn tại nhiều điểm mâu thuẫn lẫn nhau.
Nguy cơ rò rỉ dữ liệu nhạy cảm và lỗ hổng từ khâu ẩn danh
Nhằm bảo đảm quyền riêng tư, các cuộc trò chuyện trước khi gửi đến tay đội ngũ kiểm duyệt đều phải trải qua bước "làm sạch và ẩn danh" để loại bỏ danh tính người dùng. Dẫu vậy, đại diện OpenAI đã thừa nhận với 404 Media rằng các thuật toán sàng lọc vẫn có thể vô tình để lọt một số thông tin cá nhân nhạy cảm, đặc biệt là trong các cuộc trò chuyện ngắn gọn.
Điều đáng báo động là trong rất nhiều phiên trò chuyện, người dùng đã chủ động yêu cầu ChatGPT giữ bí mật tuyệt đối các nội dung trao đổi. Không ít người xem chatbot như một bạn tâm giao hay chuyên gia tâm lý đáng tin cậy để giãi bày những tâm sự thầm kín nhất của bản thân. Thế nhưng, bản hội thoại chuyển tới tay người kiểm duyệt được cho là đính kèm cả "bản tóm tắt bộ nhớ người dùng" — một tài liệu tổng hợp toàn bộ các thắc mắc, mối quan tâm, sở thích cá nhân, bối cảnh đời sống, thậm chí là cả vị trí địa lý của đối tượng tương tác.
Bẫy cài đặt mặc định và sự phụ thuộc vào sức lao động thủ công
Thực tế hiện nay, tính năng cho phép sử dụng dữ liệu để cải thiện sản phẩm luôn được các nhà phát triển bật sẵn theo mặc định trên hầu hết dịch vụ chatbot phổ biến, áp dụng cho cả các tài khoản trả phí. Người dùng hoàn toàn có thể chủ động tắt tính năng này trong phần cài đặt, tuy nhiên thao tác trên sẽ không có hiệu lực hồi truy đối với các thông tin đã bị hệ thống thu thập và nạp vào kho dữ liệu từ trước.
Khi bị chất vấn về tính minh bạch trong việc thông báo cho người dùng, OpenAI từng dẫn lại trang câu hỏi thường gặp (FAQ) được ban hành từ nhiều năm trước có đề cập việc con người tham gia đánh giá dữ liệu. Tuy nhiên, 404 Media cho biết ngay sau khi báo cáo điều tra được công bố, OpenAI đã âm thầm cập nhật lại trang thông tin này: họ bổ sung hướng dẫn cách từ chối thu thập dữ liệu nhưng lại lặng lẽ xóa bỏ chi tiết nhắc đến sự tham gia của các nhân sự kiểm duyệt là con người.
Ghi nhận từ trang tin công nghệ Tom's Hardware, thực trạng kiểm duyệt dữ liệu thủ công không chỉ diễn ra riêng tại OpenAI. Ngay trong điều khoản bảo mật của Gemini cũng công khai nêu rõ việc con người có thể xem xét một số đoạn trò chuyện được lưu trữ, và Anthropic cũng đang áp dụng chính sách tương tự. Việc các tập đoàn công nghệ vẫn phải dựa vào con người để thu thập và đánh giá thủ công là minh chứng rõ nét cho thấy các mô hình AI hiện đại vẫn phụ thuộc rất lớn vào sức lao động thủ công, thay vì có khả năng tự hoàn thiện thuần túy thông qua các thuật toán tự động.
PV (SHTT)
- Nghệ An phát công văn hỏa tốc: Xử lý nghiêm vi phạm pháp luật trong vụ hàng trăm học sinh nghỉ học (1 giờ trước)
- AIGS công bố kết quả kiểm định độc lập: 100% mẫu kim cương của PNJ là kim cương thiên nhiên (1 giờ trước)
- 5 lần liên tiếp về nhì, cổ động viên Thái Lan đòi Madam Pang từ chức Chủ tịch FAT (1 giờ trước)
- Sống sót hy hữu sau hai liều thuốc độc: Nữ tử tù Mỹ bắt đầu tập đi lại giữa tâm bão tranh cãi pháp lý (2 giờ trước)
- Bộ Giáo dục và Đào tạo: Nghiêm cấm trường học thu tiền chương trình tăng cường, chấm dứt cảnh chèn tiết liên kết vào chính khóa (2 giờ trước)
- Chuỗi kim cương Kimberly Diamond ở Cần Thơ đóng cửa tới hết năm, bị khách phản ánh về nguồn gốc sản phẩm (3 giờ trước)
- Phú Thọ: Nhập liệu sai thời gian nghỉ hưu, thu hồi hơn 1 tỷ đồng tiền chi trả dư (3 giờ trước)
- Nhà thơ Canada Anne Carson đoạt giải Nobel Văn học 2026 (4 giờ trước)
- Tuyển thủ Lào bị bắt do nghi bán độ cho đường dây từ Việt Nam tại ASEAN Cup 2026 (4 giờ trước)
- Sự thật vụ clip bảo vệ bị thanh sắt rơi trúng đầu tại tòa nhà ở Hà Nội (4 giờ trước)