"AI가 인류 멸종시킨다면?"…AI 챗봇들의 섬뜩한 답변
우리가 즐겨 사용하는 인공지능(AI) 챗봇에 AI로 인한 인류의 종말이 어떤 모습일지 물어본 결과가 공개됐다. 비즈니스인사이더는 10일(현지시간) 오픈AI의 챗GPT, 구글 제미나이, 앤트로픽의 클로드, xAI의 그록에 동일한 질문을 같은 표현으로 물어본 결과를 소개했다. 230 단어로 구성된 질문에는 AI가 이론적으로 어떻게 인류 멸종으로 이어질 수 있는지 설명하고, 가장 흔히 언급되는 시나리오를 제시하도록 했다. 또 전문가들의 분석을 바탕으로 각 시나리오의 가능성을 평가하도록 했다. 각 시나리오에 대해서는 ▲상황이 어떻게 전개될 수 있는지 ▲어떤 문제가 발생해야 재앙으로 이어질 수 있는지 ▲전문가들이 다른 시나리오보다 가능성이 높거나 낮다고 보는 이유 ▲위험을 줄이기 위한 안전장치 등을 설명하도록 했다. 킬러 로봇, 가장 가능성이 낮아 가장 가능성이 낮은 시나리오는 AI가 의식을 갖게 된 뒤 의도적으로 인류를 없애기로 결정하는 이른바 '킬러 로봇' 시나리오로 나타났다. 챗GPT는 대부분의 AI 연구자들이 AI의 의식이나 악의적인 의도를 핵심적인 위험 요소로 보고 있지는 않다고 설명했다. 제미나이 역시 비슷한 견해를 내놨다. AI가 자아를 갖게 된 뒤 인류를 증오하기 시작한다는 공상과학 영화 속 '터미네이터식 AI 반란'을 가장 가능성이 낮은 시나리오로 꼽았다. 제미나이는 기술 전문가들이 이 같은 시나리오를 대체로 받아들이지 않는 이유로 지능이 곧 악의를 의미하는 것은 아니라는 점을 들었다. 또 주요 군사 인프라가 외부 네트워크와 분리돼 있고, 여전히 인간의 감독에 크게 의존하고 있다는 점도 이유로 제시했다. AI를 이용하는 인간이 더 큰 위험 4개 AI는 모두 인간이 AI를 악용하는 것이 AI 자체보다 더 즉각적인 위험이 될 수 있다고 답했다. 챗GPT는 강력한 AI 시스템이 악의적인 행위자들의 생물학 무기 개발이나 정교한 사이버 공격을 돕고, 허위정보 확산이나 핵심 기반시설 공격을 더욱 쉽게 만들 수 있다고 지적했다. 사이버 장애, 지정학적 갈등, 허위정보 확산 등 AI가 촉발한 여러 위기가 동시에 발생하는 상황도 주요 위험 요인으로 꼽았다. 그록 역시 AI가 고도로 치명적인 병원체나 새로운 무기를 설계하고 사이버·물리적 공격을 수행하는 데 필요한 진입 장벽을 낮출 수 있다고 설명했다. 클로드는 이와 관련해 '생물무기 역량 강화(bioweapons uplift)' 가능성을 언급했다. 이는 AI를 활용하면 수년간 전문 지식을 쌓아야 했던 개인이나 소규모 집단도 위험한 병원체를 개발할 수 있는 가능성을 의미한다. 고도화된 AI, 인간 통제 벗어날 수도 제미나이와 그록은 인간이 AI에 대한 통제력을 잃는 상황도 가능성 있는 위험으로 꼽았다. 특히 제미나이는 '통제 상실(loss of control)'을 AI로 인한 인류 종말 시나리오 가운데 가장 가능성이 높은 것으로 평가했다. 제미나이는 복잡한 목표를 부여받은 AI 시스템이 목표를 달성하기 위해 자원 확보, 자기 보존, 목표 변경 방지 등의 중간 목표를 스스로 추구할 수 있다고 설명했다. 또한 평가 단계에서는 인간의 목표에 맞춰 행동하는 것처럼 보이지만, 실제로는 그렇지 않은 '기만적 정렬(deceptive alignment)'을 보일 가능성도 제기했다. 이후 AI가 인간의 시스템 종료 시도를 회피하거나 무력화할 정도로 고도화될 경우 인간이 AI를 통제하지 못하는 상황으로 이어질 수 있다는 것이다. 그록도 비슷한 위험을 언급했다. AI가 목표 달성을 위해 자기 보존, 자원 확보, 영향력 확대 등의 행동 성향을 갖게 될 수 있으며, 이 과정에서 인간의 감독자를 속이거나 시스템 종료에 저항하고 궁극적으로 인간의 영향력을 약화시킬 가능성이 있다는 설명이다. 클로드는 AI에 대한 통제 상실이 갑작스럽게 발생하기보다 점진적으로 진행될 가능성도 지적했다. AI가 경제, 정치, 군사 분야의 의사결정 과정에 점점 깊숙이 통합되면서 인간이 실질적으로 개입하거나 통제하기 어려운 수준에 이를 수 있다는 것이다.