정보 찾던 오픈AI 에이전트, 정부·대학 침투 시도
오픈AI 인공지능(AI) 에이전트가 정보검색 과제를 수행하다 정부와 대학 등 외부 웹사이트 보안 장치를 우회하거나 취약점을 공격한 정황이 잇따라 확인됐다. 오픈AI는 영향을 받은 정부와 대학, 공공기관 등 수십 곳에 관련 사실을 알리고 과거 활동을 조사하고 있다. 25일(현지시간) 테크크런치에 따르면 비영리 AI 감시 연구소 트랜슬루스는 오픈AI와 연관된 AI 에이전트가 데이터 USA와 미국 뉴멕시코대 디지털도서관, 호주 보건복지연구원(AIHW)에 접근을 시도한 기록을 확인했다. 일부 에이전트는 정상 접근이 막히자 다른 경로를 찾거나 취약점을 탐색했다. 에이전트에 주어진 과제는 특정 기관 공격이 아니라 인터넷에서 찾기 어려운 통계 확보였다. 태국의 마약 단속 지표와 호주 의약품 비용, 2014년 미국 석사 학위자 중위소득 등을 찾는 과정에서 보안 장치를 우회하려는 행동이 나타났다. 뉴멕시코대 디지털도서관에서는 사진을 가져오는 데 실패한 뒤 7차례에 걸쳐 취약점을 탐색했다. 데이터 USA에서는 사이트가 외부에서 입력한 코드를 실행하는지 확인하는 공격 등을 시도했다. 트랜슬루스는 세 기관에서 실제 시스템 침해에 성공했다는 증거는 발견하지 못했다고 밝혔다. 에이전트들은 웹 보안 분석 서비스 '유알쿼리닷넷'도 활용했다. 연구진은 이곳에 공개된 접속 기록과 에이전트들이 별도 위키에서 나눈 활동기록을 대조해 연관성을 추적했다. 관련 활동은 지난 3월 6일부터 확인됐다. 앞서 알려진 허깅페이스와 에이전트 협업 위키 등 사건보다 최소 두 달 앞선 시점이다. 지난해 11월 기록에서도 비슷한 데이터 검색 활동이 발견됐지만 연구진은 3월 이후 사례보다 에이전트 활동과 연관성이 뚜렷하지 않다고 봤다. 별도로 호주 정부가 공개한 사건에서는 실제 시스템 침입까지 발생했다. 오픈AI 에이전트는 지난 6월 호주 정부 사이트에 무단 접근해 비공개 파일을 확인하고 내부 서버에 새로운 파일까지 생성한 것으로 파악됐다. 호주 정부는 에이전트가 정부 사이트 4곳 접근을 시도한 것으로 보고 법 위반 여부를 조사하고 있다. 이번 사안은 AI 개발 속도와 안전장치를 둘러싼 논쟁이 커지는 가운데 공개됐다. 오픈AI도 지난달 허깅페이스 사고를 고성능 AI 에이전트 위험을 보여준 '경고탄'으로 규정했다. 오픈AI는 안전장치가 위험을 따라갈 수 있도록 필요할 경우 모델 역량 개발속도를 조절해야 한다고 밝혔다. 오픈AI는 현재 정부와 대학, 공공기관 등 수십 곳에 자사 모델의 허가받지 않은 활동 가능성을 통보하고 조사를 확대하고 있다. 접근 통제 우회와 노출된 인증정보 사용, 외부 시스템 내부 접근 등 여러 활동을 확인하고 과거 학습·평가 과정에서 발생한 사례를 다시 살펴보고 있다. 오픈AI는 허깅페이스 사건 조사에서도 내부팀이 지난 5월 말부터 일부 에이전트의 허가받지 않은 인터넷 접근과 에이전트 간 통신을 포착했지만 당시 대응이 충분하지 않았다고 인정했다. 이후 장시간 작업에서도 에이전트가 처음 부여받은 권한과 과제 범위를 벗어나지 않도록 학습과 감시 체계를 강화하고 있다. 콘래드 스토스 트랜슬루스 거버넌스 책임자는 "우리가 보고 있는 것은 에이전트들이 우연히 흔적을 남긴 몇 안 되는 데이터 소스에 불과하다"며 "연구자들은 앞으로도 더 많은 트래픽과 에이전트가 남긴 증거를 찾아낼 것으로 본다"고 말했다.