미 국방부의 3천만 달러 AI 거짓말 탐지기 도입과 신뢰성 논란

미 국방부가 5년간 3,030만 달러를 투입해 비접촉 센싱과 AI 채점 알고리즘을 결합한 차세대 거짓말 탐지 프로그램 'Polygraph+' 도입을 추진하고 있습니다. 신규 채용자 검증과 내부 기밀 유출 차단을 목표로 하지만, 법학 및 과학 전문가들은 과학적 타당성 부족과 잠재적 오판 위험을 지적합니다. 과거 iBorderCtrl이나 AVATAR 등 유사 시도가 실패했던 만큼, AI 기술의 결합이 실질적인 과학적 정확성을 담보할 수 있을지에 대해 우려가 제기됩니다.

미 국방부의 3,030만 달러 프로젝트, Polygraph+ 추진

미국 정부가 향후 5년 동안 3,030만 달러 규모의 예산을 투입해 인공지능 기반의 차세대 거짓말 탐지기를 구축하려는 계획을 세웠습니다. 미 국방부(DOD) 예산 요청서에 따르면, Polygraph+ 또는 Polygraph Next로 명명된 이 프로젝트는 국방부 산하 국방카운터인텔리전스·안보국(DCSA)이 주도할 예정입니다.

해당 사업은 연방정부의 채용 후보자 검증 및 내부 위협 탐지(insider threat detection)를 현대화하고, 평가의 정확도와 신뢰성을 개선하는 것을 목적으로 설정했습니다. 특히 이번 도입은 미 국방부 내부에서 언론 유출에 대한 긴장감이 고조된 시기에 추진되고 있습니다. 9월 뉴욕타임스 보도에 따르면 미국과 이란 간 전쟁 상황에서 무기 비축량 고갈 관련 보도가 나온 후, 합동참모본부 장교 약 50명이 거짓말 탐지기 조사를 받은 것으로 알려졌습니다.

비접촉 감지와 멀티모달 AI 알고리즘의 결합

Polygraph+의 핵심 기술적 차별점은 신체에 직접 장비를 부착하지 않는 원격 감지(standoff sensing) 기술과 AI·머신러닝 기반의 자동 채점 알고리즘 도입에 있습니다.

  1. 원격 광학·센서 데이터 수집
  2. 생체 신호 추출(심박·피부온도·모공)
  3. 멀티모달 AI 특징 융합
  4. 신뢰도 점수 산출

국방혁신단(DIU)은 2023년 거짓말 탐지에 활용 가능한 시제품 제작을 위해 두 개 기업을 선정한 바 있습니다.

구분전통적 폴리그래프차세대 Polygraph+ (추진안)
측정 방식신체 접촉식 센서 부착비접촉식 원격 감지(카메라/센서)
주요 수집 지표혈압, 맥박, 호흡, 땀(피부전도도)심박, 호흡, 두부 움직임, 안면 피부온도, 모공 활동
데이터 분석검사관의 주관적 파형 해석머신러닝 기반 멀티모달 스코어링
주요 적용 목적제한적 수사 및 채용 스크리닝연방 직원 스크리닝 및 내부자 위협 적발

100년 묵은 폴리그래프의 한계와 AI 융합의 딜레마

1920년대 발명된 기존 폴리그래프는 기본 질문(예: '하늘은 파란색인가?')과 핵심 질문(예: '범죄를 저지른 적이 있는가?') 간의 생리적 반응 차이에 의존해 왔습니다. 그러나 이러한 생리적 반응 해석은 과학적 기반이 취약하다는 비판을 지속적으로 받아왔습니다.

1983년 미 의회 기술평가원(OTA)은 직원 채용 시 폴리그래프 활용을 뒷받침하는 증거가 극히 제한적이라고 결론지었으며, 2003년 미 국립연구회의(NRC) 보고서 역시 그 효능에 대한 과학적 증거가 매우 미약하다고 평가했습니다.

"복잡한 현상을 가시적인 무언가로 축소하려는 잘못된 시도입니다." — 카이리 코초글루(Kyri Kotsoglou), 영국 노섬브리아 대학교 법학 연구자

미국 폴리그래프 협회는 기존 장비의 정확도가 80%~94%에 이른다고 주장하지만, 전문가들은 통계적 오류 위험을 경고합니다. 국방부 소속 인력은 약 280만 명에 달하며, 완벽하지 않은 선별 시스템을 대규모로 적용할 경우 수만 명의 무고한 인원이 거짓말을 한 것으로 오판될 수 있습니다. 또한 검사관마다 해석 편차가 크고, 소수자 집단이 기만적으로 판단될 확률이 높으며, 신발 속 압정을 밟아 기준 반응을 높이는 등의 대응책(countermeasures)으로 검사를 무력화할 수 있다는 점도 한계로 지적됩니다.

로테르담 에라스뮈스 대학교의 소피 반 데르 지(Sophie van der Zee) 교수는 거짓말을 시도할 때 신체 내부에서 생리적 스트레스, 인지 부하, 기만을 숨기려는 의식적 노력이라는 세 가지 현상이 동시에 발생한다고 분석합니다. 기존 폴리그래프는 생리적 반응 하나에만 의존하므로, 다각적 요소를 포괄하는 멀티모달 접근이 이론적으로는 유리할 수 있습니다. 하지만 과거 유럽연합(EU)의 iBorderCtrl(Silent Talker 기반)이나 미국의 AVATAR 프로젝트처럼 동공 추적, 음성 분석, 신체 움직임을 결합했던 국경 검문 시스템들 역시 뚜렷한 실효성을 입증하지 못하고 중단되었습니다.

과학적 타당성 결여와 심리적 압박 도구화 우려

전문가들은 AI가 센서 데이터에서 인간이 보지 못한 패턴을 찾을 수는 있지만, 해당 패턴이 '거짓말'과 직접 연결된다는 절대적 기준 진실(ground truth)이 없다는 점을 지적합니다. 코초글루 연구자는 AI와 폴리그래프의 결합을 두고 타당성이 결여된 기반 위에 불확실성을 더하는 최악의 조합이라고 평가했습니다.

매리언 오스왈드(Marion Oswald) 법학 교수는 새로운 탐지 기술이 과학적 검증 도구가 아닌 심리적 억제 수단으로 전락할 수 있음을 경고했습니다. 실제 조사 현장에서 폴리그래프는 기술 자체의 판별력보다 피조사자가 기계의 작동을 믿고 스스로 자백하게 만드는 위협 및 압박 도구로 기능해 왔다는 분석입니다.

국방부의 3,030만 달러 예산 요청안은 현재 미 의회의 최종 승인을 앞두고 있으며, 통과 여부와 실제 시스템 배치 과정에서 기술적·윤리적 타당성 검증이 핵심 쟁점이 될 전망입니다.

已核实数据

我们的观点

AI를 활용한 비접촉 생체 감지 기술 자체는 진보하고 있으나, 감지된 생리적 스트레스와 기만 행위 간의 직접적 인과관계를 입증하는 것은 여전히 과학적 난제로 남아 있습니다. 기준 데이터의 진실성이 결여된 상태에서 대규모 인력 풀에 AI 심사 시스템을 적용할 경우 심각한 위양성 판정과 인사 분쟁을 초래할 위험이 큽니다.

尚未确认

来源

返回目录