Anthropic chặn đứng hàng loạt tài khoản lạm dụng AI Claude để nghiên cứu vũ khí sinh học
Hãng công nghệ Anthropic vừa ngăn chặn các nhà khoa học lạm dụng AI Claude trong nghiên cứu sinh học lưỡng dụng nguy hiểm cùng nhiều hoạt động thiết kế vũ khí.
Hãng phát triển trí tuệ nhân tạo Anthropic vừa công bố việc phát hiện và vô hiệu hóa 5 trường hợp sử dụng các mô hình Claude có nguy cơ hỗ trợ nghiên cứu phát triển vũ khí sinh học. Các sự cố này được ghi nhận từ tháng 12-2025 đến tháng 8-2026, liên quan trực tiếp đến các mầm bệnh nguy hiểm như virus, bệnh truyền nhiễm cùng nọc độc và độc tố sinh học.
Đáng chú ý, những người đứng sau các phiên làm việc bị gắn cờ đều là các nhà khoa học đang hoạt động chuyên môn trong lĩnh vực nghiên cứu. Danh tính cá nhân, cơ quan chủ quản và quốc gia của những người này không được công bố. Đại diện Anthropic thừa nhận không thể xác định chính xác mục đích cuối cùng của các nghiên cứu là hợp pháp hay gây hại, nhưng buộc phải can thiệp sớm do hậu quả tiềm tàng nếu công nghệ bị lạm dụng là đặc biệt nghiêm trọng.

Nỗ lực vượt rào bảo mật và bài toán nghiên cứu lưỡng dụng
Báo cáo an toàn chỉ ra rằng một số cá nhân đã cố tình vượt qua các rào cản kỹ thuật bằng cách sử dụng tài khoản tại các khu vực bị giới hạn dịch vụ và che giấu mục tiêu nghiên cứu để qua mặt hệ thống kiểm duyệt. Trong đợt rà soát định kỳ kéo dài 30 ngày, Anthropic ghi nhận khoảng 35 nỗ lực tiếp cận có dấu hiệu tiềm ẩn rủi ro an ninh sinh học.
Một trường hợp điển hình liên quan đến virus chikungunya, tác nhân truyền qua muỗi gây sốt và đau khớp dai dẳng. Người dùng đã nhờ Claude soạn thảo hồ sơ xin tài trợ nghiên cứu về cơ chế né tránh hệ miễn dịch và tăng cường khả năng lây truyền của virus. Về mặt lý thuyết, dữ liệu này có thể hỗ trợ phát triển vaccine y tế, nhưng đồng thời cũng tiềm ẩn nguy cơ biến đổi đặc tính để tạo ra biến chủng nguy hiểm hơn. Đây chính là bản chất của các nghiên cứu lưỡng dụng, nơi lằn ranh giữa mục đích cứu trợ y tế và chế tạo vũ khí vô cùng mong manh.
Hệ thống giám sát cũng ghi nhận các yêu cầu phân tích về virus cúm gia cầm liên quan đến khả năng thích nghi trên động vật có vú, nhóm orthopoxvirus gây bệnh đậu mùa và đậu mùa khỉ, cùng việc tổng hợp các dạng độc tố mới.
Nâng cấp hàng rào kỹ thuật trước nguy cơ gia tăng
Anthropic nhấn mạnh rằng các thế hệ AI trước đây chưa đủ năng lực để giải quyết các vấn đề sinh học chuyên sâu. Tuy nhiên, khi năng lực phân tích của Claude ngày càng phát triển, công ty bắt buộc phải tích hợp nhiều lớp phòng vệ nghiêm ngặt nhằm kiểm soát những truy vấn kỹ thuật nhạy cảm.
Ngoài lĩnh vực sinh học, đơn vị này còn phát hiện các hành vi ứng dụng AI vào tấn công mạng, giám sát, lừa đảo chính trị và hỗ trợ kỹ thuật quân sự thông thường. Một số nhóm người dùng đã khai thác Claude để hỗ trợ thiết kế phần mềm phục vụ drone vũ trang, tên lửa và các loại bom.
Toàn bộ tài khoản vi phạm đều đã bị vô hiệu hóa vĩnh viễn. Dữ liệu từ các cuộc tấn công này hiện được tích hợp vào hệ thống giám sát tự động của Anthropic, đồng thời được chia sẻ với các cơ quan chính phủ và đối tác công nghệ nhằm ngăn chặn nguy cơ AI bị vũ khí hóa trong tương lai.