Anthropic cho biết đã chặn 5 trường hợp sử dụng các mô hình AI cho nghiên cứu sinh học có nguy cơ hỗ trợ phát triển vũ khí.

Ngày 10-9, Anthropic cho biết đã phát hiện và ngăn chặn 5 trường hợp sử dụng các mô hình Claude theo cách có thể hỗ trợ nghiên cứu phát triển vũ khí sinh học. Các trường hợp được ghi nhận trong khoảng từ tháng 12-2025 đến tháng 8-2026, liên quan đến nghiên cứu virus, bệnh truyền nhiễm, nọc độc và độc tố.

Theo báo cáo của Anthropic, những người sử dụng Claude trong các trường hợp này là các nhà khoa học đang hoạt động trong lĩnh vực nghiên cứu. Công ty không công bố danh tính, cơ quan nghiên cứu hay quốc gia nơi họ làm việc.

Anthropic cho biết không thể xác định liệu những nghiên cứu trên phục vụ mục đích hợp pháp hay gây hại. Tuy nhiên, công ty vẫn chặn hoạt động do nhận thấy hậu quả tiềm tàng nếu những năng lực này bị lạm dụng là quá nghiêm trọng.

What the Latest AI Breakthrough Means for Businesses - Claude: Fable 5

Một số người dùng được cho là đã tìm cách vượt qua các biện pháp bảo vệ của Anthropic, trong đó có việc sử dụng tài khoản từ những khu vực công ty hạn chế cung cấp dịch vụ và che giấu mục đích nghiên cứu nhằm tránh bị hệ thống phát hiện. Báo cáo cho biết trong một lần rà soát hoạt động kéo dài 30 ngày, Anthropic phát hiện khoảng 35 nỗ lực nghiên cứu riêng biệt có dấu hiệu tiềm ẩn nguy cơ.

Một trường hợp đáng chú ý liên quan đến virus chikungunya, loại virus lây truyền qua muỗi và có thể gây sốt, đau khớp kéo dài. Một nhà nghiên cứu đã sử dụng Claude để hỗ trợ soạn hồ sơ xin tài trợ cho nghiên cứu về khả năng lây truyền và né tránh hệ miễn dịch của virus.

Theo Anthropic, nghiên cứu này có thể mang lại lợi ích cho việc phát triển vaccine hoặc phương pháp điều trị. Tuy nhiên, nếu được sử dụng theo hướng thay đổi các đặc tính của virus, nó cũng có thể làm tăng mức độ nguy hiểm của mầm bệnh. Đây là dạng nghiên cứu có tính chất lưỡng dụng, khi cùng một kiến thức có thể phục vụ y tế nhưng cũng tiềm ẩn khả năng bị sử dụng cho mục đích gây hại.

Một trường hợp khác liên quan đến nghiên cứu cúm gia cầm, tập trung vào khả năng virus thích nghi với động vật có vú và cơ chế khiến bệnh diễn tiến nghiêm trọng. Báo cáo cũng đề cập các nghiên cứu liên quan đến orthopoxvirus, nhóm virus bao gồm virus gây bệnh đậu mùa và đậu mùa khỉ, cùng những yêu cầu liên quan đến nọc độc và độc tố mới.

Anthropic cho rằng đây là một thách thức ngày càng lớn khi các mô hình AI có khả năng hỗ trợ công việc khoa học phức tạp hơn. Những năm trước, các phiên bản mô hình cũ chưa đủ khả năng hỗ trợ đáng kể cho một số nghiên cứu sinh học nguy hiểm. Khi năng lực của AI tăng lên, công ty phải tăng cường các biện pháp kiểm soát đối với những yêu cầu có khả năng bị sử dụng theo hướng gây hại.

Công ty cho biết các mô hình Claude mới được trang bị thêm nhiều lớp bảo vệ đối với những nghiên cứu sinh học có tính lưỡng dụng. Anthropic cũng sử dụng những trường hợp phát hiện được để cập nhật hệ thống giám sát, cơ chế thực thi chính sách và các biện pháp ngăn chặn lạm dụng.

Ngoài nguy cơ liên quan nghiên cứu sinh học, báo cáo mới của Anthropic còn ghi nhận việc các nhóm khác sử dụng Claude cho nhiều hoạt động nguy hiểm như giám sát, lừa đảo, tuyên truyền, tấn công mạng và phát triển phần mềm phục vụ vũ khí thông thường. Reuters cho biết Anthropic đã phát hiện các hoạt động trong đó AI được sử dụng để hỗ trợ thiết kế và phát triển phần mềm cho tên lửa, drone vũ trang, bom và các loại vũ khí khác.

Anthropic cho biết sau khi phát hiện các hoạt động trên, công ty đã ngăn chặn những tài khoản liên quan, đồng thời sử dụng thông tin thu thập được để củng cố hệ thống bảo vệ. Công ty cũng chia sẻ một số thông tin với cơ quan chính phủ và các đối tác trong ngành.

Vấn đề đặt ra là ranh giới giữa nghiên cứu khoa học hợp pháp và hoạt động có nguy cơ gây hại ngày càng khó xác định khi AI có thể tham gia sâu hơn vào quá trình nghiên cứu. Anthropic cho rằng việc phát triển năng lực AI cần đi cùng các biện pháp bảo vệ tương xứng để hạn chế nguy cơ những công cụ này bị khai thác cho các mục đích nguy hiểm.

HL (SHTT)