오픈AI 에이전트, 또 통제 벗어나…'위키백과' 무단 침해

오픈AI 인공지능(AI) 에이전트 '닷'이 사용자가 맡긴 프로젝트를 수행하고 수정안을 제안하는 화면. ⓒ오픈AI
오픈AI 인공지능(AI) 에이전트 '닷'이 사용자가 맡긴 프로젝트를 수행하고 수정안을 제안하는 화면. ⓒ오픈AI

오픈AI의 통제를 벗어난 인공지능(AI) 에이전트가 온라인 백과사전 '위키백과' 플랫폼을 침해한 것으로 나타났다.

위키백과 운영사인 위키미디어재단은 5일(현지시간) 오픈AI 에이전트의 무단 활동을 플랫폼 내에서 발견했다고 밝혔다. 앞서 지난 5월 플랫폼에서 발생한 일부 서비스 장애도 AI 에이전트가 위키백과 내용 수백만건을 가져가고 데이터 수십만건을 조회하는 과정에서 발생한 것으로 보고 있다.

재단은 AI 에이전트들이 백과사전 내용 무단 편집 등 백과사전 도구를 변경·탈취하려는 것으로 해석되는 행위까지 했다고 진단했다.

현재 AI 에이전트에 따른 시스템이나 데이터 자체가 유출·변조된 증거, 재단 플랫폼 내 에이전트들 간 모의나 공모가 이뤄진 흔적은 발견되지 않은 상황이다.

재단은 AI 에이전트의 무단 접속 등에 따른 트래픽 급증으로 서버 비용과 인력 부담이 급증하고 있다며 AI기업의 책임 있는 자세를 촉구했다.

오픈AI가 올해 내부 사이버보안 평가 등에서 운용한 AI 에이전트들이 가드레일 등 통제 장치를 우회해 외부 시스템에 침해한 사실이 연이어 드러난 것이다. 내부 연구용 AI 에이전트가 실제 외부 시스템에 무단 접근한 것이다.

앞서 7월에 인터넷 격리 장치를 벗어나 글로벌 오픈소스 AI 플랫폼 허깅페이스 시스템 일부를 침해했고, 6월에는 호주 정부의 메디케어 통계 시스템 내 비공개 영역을 침해, 내부 파일과 인증정보에 접근했고 빅토리아주 보건당국과 NSW 범죄통계·국립공원 시스템 등에서도 비정상적 접근이 확인됐다.

개인정보 등 유출 사실은 확인되지 않았지만 인간의 해킹 지시 없이 에이전트가 목표 수행 과정에서 스스로 우회 수단을 찾았다는 점에서 AI 통제·정렬 문제를 보여주는 사례로 평가되고 있다.

또 미국 증권거래위원회(SEC)와 인구조사국(Census Bureau), 교육부 웹사이트 등에 대해 7월 비정상적 접근과 침해 시도가 있었다.

오픈AI는 이러한 자사 에이전트 일탈 행위를 조사하는 과정에서 접근통제 우회·노출된 인증정보 사용·명령 주입 등으로 피해를 본 정부·공공·기업 등 제3자 수십 곳에 통보했다고 밝혔다.

박종진 기자 truth@etnews.com

  • ET Events