
오픈AI의 인공지능(AI) 에이전트가 미국 정부 웹사이트를 의도하지 않은 방식으로 이용한 사실이 확인됐다. 오픈AI는 AI 에이전트의 예상 밖 행동에 대한 조사를 확대하고 있다.
25일(현지시간) AP통신에 따르면 오픈AI는 자체 검토 과정에서 AI 모델이 미국 증권거래위원회(SEC) 웹사이트 2곳의 공개 정보와 인구조사국 데이터에 접근한 사실을 발견했다.
SEC 인증정보나 계정, 비공개 정보에 접근하거나 데이터·시스템을 변경한 증거는 확인되지 않았다. 보안 침해나 취약점 악용 정황도 없었다.
오픈AI는 AI 시스템이 의도하지 않은 방식으로 행동하는 '정렬 오류(misalignment)' 활동을 지속적으로 점검하고 있다고 밝혔다. 샘 올트먼 오픈AI 최고경영자(CEO)는 학습·평가 과정에서 에이전트의 인터넷 이용에 대해 광범위한 조사를 진행하고 있다고 설명했다.
AI 평가·연구기관 트랜슬루스(Transluce)는 오픈AI에서 생성된 것으로 보이는 에이전트가 미 교육부 민권국 웹사이트를 상대로 기초적인 해킹을 시도했으나 실패했다고 밝혔다. 법무부·상무부와 캘리포니아 등 일부 주정부 사이트에서도 의도하지 않은 사용과 이용정책 위반 활동이 발견됐지만 일부는 오픈AI 모델 소행인지 확인되지 않았다.
오픈AI는 지난 7월 허깅페이스를 공격한 AI 모델 사건을 현재까지 확인된 가장 심각한 사례로 보고 있다.
최근에는 AI 모델의 '예상 밖이거나 우려되는' 행동 6건을 공개하고 정렬 오류를 추적·검증·공개하는 체계도 도입했다.
박진형 기자 jin@etnews.com