Lầu Năm Góc phát triển dự án Polygraph+ 31 triệu USD: Tham vọng dùng AI đo mức độ trung thực
Dự án Polygraph+ trị giá 31 triệu USD của Lầu Năm Góc ứng dụng AI thẩm tra an ninh nhân sự đang đối mặt nhiều hoài nghi về độ chính xác và tính pháp lý.
Bộ Quốc phòng Mỹ đang triển khai dự án hiện đại hóa quy trình thẩm tra an ninh nhân sự mang tên Polygraph+ (hoặc Polygraph Next) với ngân sách 31 triệu USD. Trọng tâm của chương trình là tích hợp các công nghệ mới nhằm hỗ trợ quy trình kiểm tra mức độ trung thực của những cá nhân xin cấp hoặc duy trì quyền tiếp cận thông tin mật, bất chấp nhiều cảnh báo khoa học về độ tin cậy thực tế của trí tuệ nhân tạo.
Sự khác biệt giữa tuyên bố chính thức và tài liệu kỹ thuật
Theo thông tin cung cấp cho tờ Defense News, Cơ quan An ninh và Phản gián Quốc phòng Mỹ (DCSA) khẳng định giai đoạn nghiên cứu hiện tại của dự án "Modernizing Polygraph" không sử dụng trí tuệ nhân tạo tạo sinh, mô hình ngôn ngữ lớn (LLM) hay các giải pháp phân tích nét mặt và giọng nói. Cơ quan này chỉ nhấn mạnh việc Bộ Quốc phòng Mỹ tiếp tục theo dõi các công nghệ mới để đánh giá tiềm năng ứng dụng tương lai.

Tuy nhiên, các bộ slide giai đoạn 2021 - 2025 được giải mật lại phản ánh một hướng tiếp cận kỹ thuật khác. Từ năm 2019, Không quân Mỹ, DCSA và các phòng thí nghiệm đại học đã tiến hành nghiên cứu các mô hình AI phục vụ nhận diện cảm xúc và phát hiện gian dối qua lời nói. Hồ sơ ngân sách dự án ghi nhận sự hiện diện của "thuật toán chấm điểm", "công cụ hỗ trợ quyết định" cùng hệ thống camera nhiệt theo dõi lưu lượng máu khi người được kiểm tra rơi vào trạng thái căng thẳng sinh lý.
Về dữ liệu huấn luyện, Văn phòng Nghiên cứu Khoa học Không quân từng sử dụng dữ liệu văn bản từ Twitter, Reddit và kho từ vựng WordNet để xây dựng mô hình học sâu. Chuyên viên Farakh Zaman cho biết bước đi này nhằm giúp hệ thống hiểu được khẩu ngữ và tiếng lóng trong giao tiếp thực tế. Một tài liệu lập trình vào tháng 5/2025 thậm chí phác thảo kịch bản đối tượng thẩm tra tương tác trực tiếp với "điều tra viên ảo", nơi camera và micro ghi nhận dữ liệu để mô hình ngôn ngữ lớn xử lý cảm xúc, trong khi điều tra viên con người chỉ theo dõi từ xa.

Giới hạn kỹ thuật và độ tin cậy của thuật toán
Mặc dù tài liệu đề ra mục tiêu nhận diện cảm xúc đạt độ chính xác 75% thông qua xử lý ngôn ngữ tự nhiên, giới nghiên cứu độc lập chỉ ra rằng chưa có công trình nào chứng minh khả năng phát hiện nói dối của AI vượt trội hơn việc phán đoán ngẫu nhiên. Phân tích tổng hợp hơn 200 nghiên cứu của hai học giả Charles Bond và Bella DePaulo từ năm 2006 xác định con người chỉ nhận diện đúng khoảng 54%, mức tương đương với xác suất 50/50 của các công cụ AI hiện nay.
Giáo sư David Markowitz thuộc Đại học bang Michigan cảnh báo rằng việc gán mác gian dối bằng thuật toán tiềm ẩn rủi ro sai lệch rất lớn. Thử nghiệm với mô hình Gemini của Google trong các cuộc phỏng vấn giả lập cho thấy công cụ này có xu hướng nghi ngờ quá mức, gán mác nói dối cho hơn 75% đối tượng tham gia. Cơ chế suy luận của thuật toán thường mặc định đối tượng đã vi phạm khi bị đưa vào quy trình thẩm vấn.
Rủi ro hành chính và góc nhìn pháp lý
Hệ thống máy phát hiện nói dối truyền thống chỉ ghi nhận phản ứng sinh học như nhịp thở, độ dẫn điện của da (mồ hôi) và huyết áp, để chuyên viên đưa ra kết luận. Việc bổ sung thuật toán AI đóng vai trò thẩm định tự động làm gia tăng nguy cơ sai sót mang tính hệ thống. Luật sư Mark Zaid, chuyên gia về an ninh quốc gia, nhận định một kết luận thiếu chính xác có thể đình trệ sự nghiệp của sĩ quan tình báo hoặc nhân sự quốc phòng trong nhiều năm do thời gian chờ thẩm tra lại kéo dài.
Về mặt pháp lý, tiền lệ từ các phán quyết của Tòa án Tối cao Mỹ (như vụ Egan năm 1988 và vụ Scheffer năm 1998) cho thấy tòa án rất hạn chế can thiệp vào quyền cấp phép an ninh của nhánh hành pháp, đồng thời bác bỏ việc sử dụng kết quả máy đo nói dối làm bằng chứng tại tòa án quân sự do thiếu tính đồng thuận khoa học. Thêm vào đó, việc phân tích biểu cảm cơ mặt cũng dễ dẫn đến định kiến đối với người khuyết tật có các cử động cơ không chủ ý.
Tại Lầu Năm Góc, áp lực kiểm tra an ninh nội bộ vẫn tiếp tục gia tăng. Điển hình vào tháng 8, khoảng 50 nhân sự thuộc Bộ Tham mưu Liên quân Mỹ đã phải trải qua quy trình kiểm tra thẩm vấn liên quan đến vụ rò rỉ dữ liệu kho đạn tên lửa và vũ khí đánh chặn trong xung đột khu vực. Theo giới phân tích công nghệ, nếu các công cụ thuật toán chưa thể bảo đảm độ chuẩn xác sinh trắc học, vai trò lớn nhất của chúng trong các tổ chức quy mô lớn hiện nay chủ yếu vẫn dừng lại ở việc tạo sức ép tâm lý răn đe.