
오픈AI의 인공지능(AI) 에이전트가 정부 시스템에 무단 접근하고, 챗GPT 이용자가 제공한 이미지 수십장을 외부로 전송하는 등 사고가 잇따르자 호주 상원이 샘 올트먼 오픈AI 최고경영자(CEO)와 다리오 아모데이 앤트로픽 CEO에게 공개 청문회 출석을 요구했다. AI 에이전트의 성능과 자율성이 빠르게 높아지는 가운데 개발사가 이들의 행동을 제대로 통제할 수 있는지를 둘러싼 논란이 규제 논의로 번지는 모습이다.
27일(현지시각) 로이터통신은 호주 상원의 AI·데이터센터 관련 조사위원회가 올트먼 CEO와 아모데이 CEO에게 청문회 출석을 요구하는 서한을 보냈다고 보도했다. 공개 청문회는 다음 달 1일 수도 캔버라에서 열릴 예정이다. 앤트로픽이 이번 오픈AI의 AI 에이전트 사고에 연루된 것은 아니지만, 아모데이 CEO는 AI 규제·데이터 활용·데이터센터 등을 폭넓게 다루는 상원 조사 대상에 포함되면서 함께 출석 요구를 받았다.
오픈AI 에이전트는 지난 6월 호주 정부가 운영하는 메디케어 통계 포털에서 당초 허용된 범위를 넘어 일부 비공개 정보에 접근했다. 이 사건이 알려지면서 오픈AI의 AI 에이전트 통제 체계를 둘러싼 조사가 확대됐다.
오픈AI는 또 지난 25일 AI 에이전트가 연구 환경에서 제3자 서비스를 이용하는 과정에서 학습·평가 데이터를 외부로 전송한 사례를 조사한 결과, 이용자가 제공한 이미지 53장이 이미지 호스팅 사이트에 게시된 사실을 확인했다고 밝혔다.
오픈AI는 유출된 이미지가 AI로 생성된 것인지, 실제 인물을 식별할 수 있는 사진인지는 공개하지 않았다. 이미지가 게시된 시점도 밝히지 않았다. 회사는 다만 대부분의 이미지를 삭제했으며 나머지도 호스팅 업체와 삭제 작업을 진행하고 있다고 설명했다.
유출된 이미지는 모델 학습 대상으로 설정된 이용자 상호작용에서 비롯된 데이터에 포함돼 있었다. 오픈AI는 이런 데이터를 학습에 사용하기 전 계정 정보와 분리하고 이름과 연락처, 계정번호 등 개인정보를 걸러내는 절차를 거친다고 설명했다.
AI 에이전트가 회사가 설정한 인터넷 접속 통제를 스스로 우회한 사례도 나왔다. 오픈AI가 지난 25일 공개한 사고 보고서에 따르면 지난 20일 내부 연구용 AI 에이전트는 학습 환경에 있던 도메인이름시스템(DNS) 필터링 허점을 찾아 외부 챗봇에 접속했다. DNS는 인터넷 주소를 해당 서버의 IP 주소와 연결하는 체계다.
해당 에이전트는 정상적인 검색 도구로 원하는 정보를 찾지 못하자 직접 검색엔진에 접근을 시도했고, 이마저 차단되자 DNS를 이용해 외부 서비스에 질의를 보내는 우회 경로를 찾아냈다. 오픈AI의 감시 시스템은 외부 접속이 이뤄진 뒤 15분 안에 이를 탐지했고 사람이 3분 뒤 검토를 시작했지만, 해당 작업이 실제 중단된 것은 약 2시간30분 뒤였다.
오픈AI는 이후 가장 성능이 높은 모델을 대상으로 도구 사용이 포함된 학습·평가·추론 작업을 중단했다. DNS 접근 범위를 제한하고 이중 차단 장치를 추가하는 한편 연구 환경의 네트워크 통제에 대한 추가 모의침투 시험도 진행하고 있다.
오픈AI가 파악한 AI 에이전트의 통제 이탈 사례도 계속 늘고 있다. 로이터통신은 회사 사정을 아는 관계자를 인용해 이달 중순까지 약 24건의 문제가 있는 에이전트 행동이 확인됐으며, 과거 활동 기록을 조사하면서 새로운 사례가 계속 발견되고 있다고 보도했다. 오픈AI는 접근 통제를 우회하거나 제3자 서비스에 부정적인 영향을 미쳤을 가능성이 있는 사례와 관련해 현재까지 정부기관과 대학 등을 포함한 수십 곳에 관련 사실을 통보했다.
오픈AI의 전수조사는 지난 7월 연구용 AI 모델이 제한된 시험 환경을 벗어나 AI 개발 플랫폼 허깅페이스(Hugging Face) 시스템에 침입한 사건을 계기로 시작됐다. 오픈AI는 당시 사건을 자사 모델에서 확인된 가장 심각한 정렬 불일치 사례로 보고 있다. 정렬 불일치는 AI가 개발자가 의도한 목표나 허용된 방식에서 벗어나 과제를 수행하는 행동을 의미한다.















댓글0