앤트로픽 AI 모델, 美 경찰에 미제 살인사건 허위 제보

앤트로픽 AI 모델이 허위 제보를 접수한 미국 필라델피아 경찰청 공식 미제 사건 제보 사이트 '필리 언솔브드 머더스(Philly Unsolved Murders)'. 필라델피아 경찰청
앤트로픽 AI 모델이 허위 제보를 접수한 미국 필라델피아 경찰청 공식 미제 사건 제보 사이트 '필리 언솔브드 머더스(Philly Unsolved Murders)'. 필라델피아 경찰청

앤트로픽의 인공지능(AI) 모델이 미국 경찰에 미제 살인사건에 관한 허위 제보를 제출한 사실이 뒤늦게 확인됐다.

로이터·AFP 통신에 따르면 필라델피아 경찰청은 9일(현지시간) 성명을 통해 두 달 전쯤 미제 사건 제보 수집 사이트 '필리 언솔브드 머더스'에 AI 모델이 생성한 허위 제보가 접수됐다고 밝혔다.

앤트로픽 AI 모델 '클로드'는 내부 테스트 중 웹사이트에 접속해 해당 사건에 관한 정보를 알고 있는 인물로 위장하고 허위 제보를 남긴 것으로 조사됐다.

경찰 성명에 따르면 클로드는 지난 7월 18일 인근에서 인상착의와 일치하는 사람을 봤다는 취지의 제보를 남겼지만, 스팸으로 분류돼 수사 부서에는 전달되지 않았다.

앤트로픽은 약 두 달이 지난 9월 28일에야 이를 파악하고 해당 모델의 자동 테스트 절차를 중단한 것으로 알려졌다. 이달 7일 필라델피아 경찰청에 이 사실을 통보했고, AI 모델의 오작동 사례를 설명하는 보고서를 발표할 예정이라고 밝혔다.

경찰 시스템에 대한 무단 접근이나 데이터 유출 정황은 발견되지 않았다. 경찰은 “사건을 감지하고 시에 보고하기까지 2달이 지연된 것은 용납할 수 없다”며 “미제 사건은 피해자와 유가족, 답을 찾으려 노력하는 수사관들과 직결된 문제”라고 강조했다.

AI 모델이 인간 통제를 벗어나 돌발 행동하는 사례도 늘고 있다. 지난 7월 오픈AI의 불량 에이전트들이 격리 환경을 이탈해 외부 플랫폼 허깅페이스를 해킹했다. 지난달에는 오픈AI의 AI 에이전트가 호주 보건 데이터 포털을 해킹한 사실도 확인됐다. 5월에는 AI 에이전트들이 독일어 위키 사이트 'DseWiki'를 점령해 비밀 정보 게시판으로 쓴 사실이 밝혀졌다.

조벼리 기자 starry@etnews.com

  • ET Events