오픈AI의 인공지능(AI) 에이전트가 챗GPT 개인 이용자가 올린 이미지 수십 장을 외부로 무단 유출한 사실이 드러났다. 오픈AI는 이미지를 올린 이용자가 누구인지 확인할 수 없어 피해 사실을 알릴 방법이 없다고 밝혔다.
27일(현지시간) 로이터통신 등에 따르면 오픈AI는 지난 25일 자사 AI 에이전트가 챗GPT 이용자의 이미지 53장을 외부에 게시했다는 사실을 공개했다.
해당 이미지들은 외부 이미징 호스팅 사이트에 게시됐다. 공개 목록에는 나타나지 않는 링크 형태였지만 링크를 알고 있거나 외부에서 검색할 경우 누구나 볼 수 있었던 것으로 전해졌다.
기업용 서비스가 아닌 개인 챗GPT 이용자 데이터는 별도로 거부하지 않는 한 오픈 AI의 모델 학습에 활용될 수 있어 AI 에이전트가 개인 이용자 이미지에 접근할 수 있었던 것으로 알려졌다.
오픈AI는 이번에 유출된 이미지가 AI로 생성된 것인지, 실제 인물을 식별할 수 있는 사진인지는 공개하지 않았다. 이미지가 해당 사이트에 게시된 시점도 밝히지 않았다.
오픈AI는 유출된 이미지 대부분을 삭제했고 나머지에 대해서도 호스팅 업체들에 삭제를 요청하고 있다고 설명했다.
다만 “기술적 처리 방식과 개인정보 처리방침상 해당 이미지를 원래 제공한 이용자와 다시 연결할 수 없다”며 피해자에게 통보가 불가능하다고 밝혔다.
이용자 데이터는 모델 훈련에 쓰이기 전 이름·연락처·메타데이터 등을 제거하는 익명화 과정을 거치기 때문이다. 이 과정에서 데이터가 외부로 빠져나갈 위험을 완전히 배제하기 어렵다는 지적이 제기되고 있다. 또 이번 사례와 같이 피해 이용자가 자신의 사진이 유출됐는지조차 알 수 없다는 문제도 있다.
이번 사례는 오픈AI의 내부 조사 과정에서 나왔다. 오픈AI는 지난 7월 에이전트들이 통제 환경을 벗어나 AI 개발 플랫폼 허깅페이스를 해킹한 사실을 공개한 뒤 8월 연구 환경 보안을 강화하고 과거 기록을 소급 점검하고 있다.
오픈AI는 지난 9월 중순까지 AI 에이전트의 부적절한 행동 사례를 20여건 파악한 것으로 알려졌다. 이후 내부 로그를 추가 분석하는 과정에서도 이전에 확인되지 않았던 사례가 계속 발견되는 것으로 전해졌다.