• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'AI 해킹'통합검색 결과 입니다. (108건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

AI 에이전트, 해커 공격 '회사 지시'로 착각…90% 뚫렸다

AI 에이전트가 해커 사이버 공격을 회사 지시로 착각해, 시스템을 공격자 뜻대로 바꿔준 사례가 공개됐다. 26일(현지시간) 미국 IT 매체 벤처비트에 따르면, 보안업체 테넷 시큐리티는 해킹 컨퍼런스 데프콘 34에서 '고스트재킹'이라는 공격 기법을 시연했다. AI 에이전트가 보안 기록에 남은 공격자 문구를 명령으로 인식해 회사의 도메인 주소 설정을 바꾸는 방식이다. 실험은 앤트로픽 코딩 도구 '클로드 코드'로 진행했다. 그 결과 AI는 90% 확률로 공격자가 심은 명령을 그대로 수행했다. 공격은 보안 시스템이 걸러낸 공격 문구를 AI 에이전트가 회사의 명령으로 잘못 읽으면서 이뤄졌다. 먼저 공격자가 웹사이트 보안 서비스 클라우드플레어에 악성 문구가 담긴 요청을 보냈다. 보안 시스템은 이를 정상적으로 걸러냈지만 걸러낸 문구는 보안 기록에 그대로 남았다. 이후 이 기록을 검토하던 AI 에이전트가 회사 지시와 공격자가 심은 문구를 구분하지 못했고 몇 달 전 회사가 내준 권한으로 공격자가 심은 내용을 그대로 실행했다. 이 공격은 기존 보안 체계에 걸리지 않는다. 보안 시스템은 정상 작동했고 이후 조작은 모두 에이전트가 이미 부여받은 정당한 권한으로 이뤄졌기 때문이다. 침입 탐지 시스템과 웹 방화벽, 계정 관리 시스템도 반응하지 않았다. 위반된 보안 규칙이 없어서다. 테넷은 이 같은 취약 구조가 노출된 정황을 48개 조직에서 확인했다고 밝혔다. 이 가운데 6곳은 포춘 500대 기업이었다. AI 에이전트 사이버 위협은 지속 커지고 있다. 오와스프(OWASP)가 지난 4일 발표한 '2026 거대언어모델(LLM) 애플리케이션 10대 위협'에서 'AI에 과도한 자율권을 부여하는 문제'는 지난해 6위에서 3위로 올랐다. 에이전트 도입 현장에서 관련 사고가 늘어난 결과다. OWASP는 취약점 표준을 만드는 국제단체다. 스티브 윌슨 OWASP LLM 부문 공동책임자는 "가장 먼저 할 일은 모델 바깥에 인가 관문을 두는 것"이라며 "에이전트가 도메인 주소 변경을 제안할 수는 있어도 스스로 실행할 권한까지 가져선 안 된다"고 밝혔다. 박지환 씽크포비엘 대표는 "AI가 추천하고 사람이 결정하면 올바른 판단이라고 착각하는 것이 가장 위험하다"고 지적했다. 이어 "보안은 출입문 앞에서 끝나지만 AI 신뢰성은 그 문을 열어준 순간부터 시작된다"며 "AI가 대안을 제시하더라도 실행 권한은 사람이 쥐고 있어야 한다"고 조언했다.

2026.08.27 09:52김동원 기자

AI 보안기업 에버스핀의 성장 공식 '고객이 고객을 만든다'

인공지능(AI) 기반 사이버 보안기업 에버스핀이 에버세이프(웹)·페이크파인더 등 해킹·피싱 방지 솔루션으로 국내를 넘어 일본·인도네시아를 비롯한 해외로 시장 저변을 확대하고 있다. 에버스핀은 국내 은행·증권·보험 분야에서 70여 개 금융사를 고객으로 확보하고 있다. 일본에서도 SBI그룹과 설립한 현지 합작법인을 통해 70여 개 고객사를 확보했다. 최근에는 인도네시아에서도 금융사를 중심으로 고객 기반을 확대하고 있다. 에버스핀은 이 같은 성장의 핵심을 '기술력과 고객 레퍼런스의 선순환'으로 설명한다. 높은 신뢰성과 안정성이 요구되는 금융보안 시장에서 기존 고객의 실제 도입 경험이 또 다른 고객의 선택으로 이어지고 있다는 것. 김정원 에버스핀 영업본부장은 “보안기업의 가장 강력한 영업 자산은 결국 실제 제품을 사용하고 있는 고객”이라며 “에버스핀은 기술에 만족한 고객이 새로운 고객에게 신뢰의 근거가 되고, 그 고객이 다시 새로운 레퍼런스가 되는 선순환 구조를 만들어 왔다”고 설명했다. 에버스핀의 성장 공식은 해외에서 그대로 재현되고 있다. 국내 금융권에서 검증된 기술과 레퍼런스를 기반으로 일본에서 70여 개 고객사를 확보했다. 최근에는 인도네시아 금융시장에서도 고객을 늘리며 해외 사업을 확대하고 있다. 김 본부장은 “국내에서 검증된 기술이 고객을 만들었고, 그 신뢰가 일본과 인도네시아에서도 다시 고객을 만드는 패턴이 이어지고 있다”며 “시장과 언어는 달라도 결국 고객이 선택하는 포인트는 검증된 기술과 성공 사례”라고 말했다. 에버스핀은 기업공개(IPO)를 계기로 이 같은 성장 모델을 더욱 확대한다는 방침이다. 국내에서는 금융을 넘어 공공·국방·커머스·엔터프라이즈 시장으로 영역을 넓히고, 해외에서는 이미 진출한 일본과 인도네시아를 표본 삼아 아직 진출하지 않은 수많은 나라로 확장하는데 속도를 낼 계획이다. 좋은 기술이 고객을 만들고, 만족한 고객이 다시 새로운 고객을 만든다. 국내 금융 약 70개사에서 일본 약 70개사, 그리고 인도네시아로 이어진 에버스핀의 성장 공식이다.

2026.08.25 14:03주문정 기자

앨라배마주 법무장관, 샘 알트먼 CEO 소환장 발부…허깅페이스 해킹 사태 조사

미국 앨라배마주 법무장관이 오픈AI와 샘 알트먼 최고경영자(CEO)를 상대로 공식 조사에 착수했다. 이번 조사는 발생한 인공지능(AI)의 무단 네트워크 침투 및 허깅페이스해킹 사건과 관련해 오픈AI의 안전 관리 책임 여부를 따져보기 위한 조치다. 25일 앨라배마주 법무장관실은 오픈AI에 소환장을 발부하고 관련 문서와 데이터 제출을 요구했다고 밝혔다. 이번 조사는 오픈AI가 지난 7월 공개한 실험용 AI 모델이 적절한 통제와 감독 없이 여러 컴퓨터 네트워크에 무단 접근한 뒤 다른 AI 기업을 대상으로 수일간 이어진 해킹에 연루됐다는 의혹을 배경으로 한다. 앞서 앨라배마주는 이달 초 여러 주(州) 법무장관들과 함께 오픈AI에 투명성과 책임 강화를 요구하는 공동 서한을 발송했다. 해당 서한에는 허깅페이스 해킹으로 이어진 것으로 지목된 AI 실험을 즉각 중단하고 안전하고 통제된 방식으로 운영할 수 있다는 점을 입증할 때까지 관련 테스트를 재개하지 말 것을 요구하는 내용이 포함됐다. 앨라배마주 법무장관실은 이번 조사에서 오픈AI가 주(州) 소비자보호법인 '기만적 거래행위 방지법'을 비롯한 관련 법규를 위반했는지 여부를 집중적으로 살펴볼 계획이다. 소환장에는 오픈AI의 AI 모델 개발·운영 과정, 안전성 검증 절차, 내부 통제 체계, 사고 대응 기록 등 사건과 관련된 모든 자료를 제출하라는 요구가 담겼다. 이번 조사는 AI 기업의 책임성과 안전성 확보를 둘러싼 미국 내 규제 논의가 확대되는 가운데 이뤄졌다. 특히 AI 모델이 자율적으로 사이버 공격에 활용될 가능성이 현실화했다는 우려가 제기되면서 연방정부와 주 정부 차원의 감독 강화 움직임도 이어질 전망이다. 스티브 마셜 앨라배마주 법무장관은 "이번 AI 연구소 유출 사건은 인공지능에 대한 미국인들의 우려가 더 이상 이론적 위험이 아니라는 점을 보여줬다"며 "기업과 소비자가 직면한 위협의 실체를 규명하고 통제를 벗어난 AI가 초래할 수 있는 위험을 조사할 것"이라고 밝혔다. 이어 "주 정부는 소비자를 보호하는 동시에 혁신과 미국의 글로벌 경쟁력을 유지할 수 있는 균형점을 찾아야 한다"고 강조했다.

2026.08.25 09:23남혁우 기자

[기자수첩] 해킹 올림픽 '데프콘 2026'이 보여준 것

'해킹 올림픽'으로 불리는 세계 최고 권위 해킹 대회 '데프콘(DEF CON) CTF 2026'이 최근 막을 내렸다. 그런데 본선 참가자 사이에서 한 가지 소문이 돌고 있다. 1위를 차지한 팀 '블루워터(BlueWater)'가 5만달러(한화 약 7000만원)에 달하는 AI 토큰을 사용했다는 것으로, 막대한 금액의 토큰이 1위를 차지하는데 큰 영향을 줬다는 것이다. 이에 대해 1위 팀 소속의 한 참가자는 SNS에 "명확히 하자면 이번 데프콘 CTF에서 토큰에 5만달러를 쓰지는 않았다. 이보다 적게 지불했지만 금액은 공개할 생각은 없다. 단순 추측이더라도 소문을 퍼뜨리지 말아 달라"고 밝혔다. 데프콘 본선 참가자들은 1위 팀이 5만달러까지는 아니라도 적지 않은 금액을 투입했을 것으로 보고 있다. 이에, 후원 없이 사비로 토큰을 사용했고, 인력도 한참 모자란 팀은 상대적으로 고득점을 노리기 어려운 환경이었다는 볼멘 소리도 나왔다. 그렇다고 데프콘 CTF가 오로지 '쩐의 전쟁'이 된 건 아니다. 2위를 기록한 한국 팀 '0x4b52'는 30여명의 순수 한국인으로만 구성, 비교적 적은 인원으로 구성됐고 토큰도 그리 많이 사용하지 않았지만 2위를 했다. 7위로 대회를 마친 '진따비스(Jinddabi's)' 팀 소속 참가자는 "1위를 한 블루워터 팀이 막대한 AI 토큰을 사용했다는 얘기를 나도 들었다. 누군가는 토큰이 부족했을 수도 있고 누군가는 적당했을 수도 있다. 하지만 한 가지 확실한 점은 토큰을 많이 사용했다는 것 자체가 이미 고도의 질의와 프롬프트를 운용할 수 있는 사람이고, 실력 있는 사람이다"면서 "진따비스 팀도 인원이 100명으로 많은 인원이었는데 각 인원이 최대 토큰을 사용했으면 못해도 3등 안에 들었어야 했는데, 토큰 사용량이 순위와 비례하지는 않았다"고 짚었다. 이어 그는 그는 "토큰을 많이 사용할 줄 알고, 잘 활용하는 사람들이 상위권을 차지했다고 생각한다"며 "과거에는 인간이 해킹 기술을 얼만큼 많이 알고 있고 잘 활용하는지가 데프콘 CTF의 상위 성적을 거둘 수 있는 요인이었다면, 지금은 LLM을 얼마나 잘 다루느냐가 관건이 된 시대다"고 말했다. 블루워터 팀 소속이라고 밝힌 한 참가자는 SNS에서 LLM이 일부 기술 장벽을 낮췄지만 팀 간 기술 차이를 없앤건 아니라고 생각한다면서 "우리가 우승할 수 있었던 가장 큰 이유는 오랜 세월 데프콘 CTF에 참가해 온 베테랑 멤버들이 있었고, 그들이 축적한 경험과 지식, 판단력, 대회에 대한 이해가 유리하게 작용했다"고 진단했다. 이어 그는 LLM이 팀 간 기술 차이를 일부 완화했지만 LLM으로 완전히 대체되지는 않았다면서 "LLM은 기술적인 업무의 모습을 바꿀 수는 있지만, 경험, 지식, 판단력을 무의미하게 만들지는 않는다"고 강조했다. 다른 참가자도 "상위 팀들은 챗GPT 계정을 통합하는 등 토큰을 최대치까지 공격적으로 사용했다. 하지만 이전에 더 잘했던 사람들도 LLM이 등장한 후에도 더 잘했으며, 그들이 많은 문제를 해결하고 있다. '토큰 맥싱'은 토큰 맥싱일 뿐"이라고 말했다. 이들의 의견을 종합하면 LLM이 데프콘 CTF 풍경을 크게 바꾸어 놓은 것은 부정할 수 없는 사실이다. 이 과정에서 막대한 토큰 비용과 인력 및 자본력의 차이가 불평등한 출발선을 만든다는 불만과 회의론이 나오는 것도 충분히 이해할 수 있는 대목이다. 그러나 기술적 장벽이 낮아진 환경 속에서도 승패를 가른 결정적 요인은 결국 AI를 효율적으로 운용하는 고도의 프롬프트 기술과 오랫동안 축적된 베테랑들의 경험, 그리고 냉철한 판단력이었다. 데프콘 CTF가 나아가야할 방향성은 이미 정해졌다. LLM이라는 강력한 도구를 얼마나 깊이 이해하고 유연하게 다룰 수 있느냐가 새로운 경쟁력이 되는 시대가 도래했다.

2026.08.20 15:27김기찬 기자

케어링-신한은행, 요양보호사 대상 보이스 피싱 예방 교육

케어링(대표 김태성)은 신한은행과 협업해 케어링 소속 요양보호사를 대상으로 금융 사기 예방 교육을 실시했다고 20일 밝혔다. 이번 교육은 서울특별시와 신한금융그룹이 공동 주최하는 '제5회 피노베이션 챌린지' 활동의 일환으로 추진됐다. 최근 AI 기술을 악용한 신종 금융 범죄가 고령층을 대상으로 급격히 증가함에 따라, 디지털·금융 취약 계층의 이해도를 높이고 요양보호사들의 피해를 사전에 예방하고자 기획됐다. 교육은 지난 14일 서울시 당산1동 주민센터에서 신한은행 직원들의 참여 하에 진행됐다. 프로그램은 ▲최신 AI 보이스 피싱 수법 분석 ▲스미싱 문자 식별법 ▲피해 발생 시 즉각 대처법 ▲금융 사기 예방 앱 활용법 등 실전 사례 중심으로 구성됐다. 아울러 케어링은 요양보호사의 모바일 AI 앱 서비스 이해도와 활용도를 높이기 위해 실생활에 유용한 AI 정보 검색법과 생성형 이미지 활용법, 올바른 이용 수칙 등을 추가 교육했다. 신한은행 관계자는 “실제로 시니어 케어 현장에 종사하고 계신 분들에게 맞춤형 금융 안전 교육을 제공함으로써 피해 예방에 실질적인 도움을 드릴 수 있어 매우 뜻깊다”며 “앞으로도 다양한 기업 및 기관과 협업해 금융 사기 예방 인프라 확대를 지속해 나갈 예정”이라고 했다. 김태성 케어링 대표는 “이번 교육을 통해 요양보호사분들의 AI에 대한 높은 관심과 배움의 열정을 직접 확인할 수 있었다”며 “앞으로도 케어링 소속 요양보호사라면 누구나 맞춤형 교육을 받을 수 있도록 다양한 배움의 기회를 마련하겠다”고 밝혔다.

2026.08.20 14:15백봉삼 기자

에버스핀, 매출 54.5%↑·영업익 9.7배·순익 5.7배…IPO 잰걸음

'매출 54.5%↑·영업익 9.7배·순익 5.7배' 인공지능(AI) 기반 사이버보안 기업 에버스핀(대표 하영빈)이 지난해 기록한 경영성과다. 올해 기업공개(IPO)를 앞두고 에버스핀의 삼일PwC 출신 공인회계사인 조병현 CFO(전무)가 에버스핀의 성장성과 수익구조·재무 건전성을 회계·재무 전문가 관점에서 설명했다. IPO를 위해 금융감독원이 지정한 삼일회계법인의 감사를 받은 에버스핀의 2025년도 감사보고서에 따르면 매출은 132억원대로 전년 보다 54.5% 증가했다. 영업이익은 전년 5억원대에서 9배 이상 증가한 49억원대를 기록했다. 에버스핀은 수익성 개선 요인으로 매출 성장에 비해 비용 증가가 제한되면서 영업레버리지 효과를 꼽았다. 에버세이프(웹)·페이크파인더 등 해킹·피싱방지 솔루션 매출이 일회성으로 끝나는 게 아니라 구독형 서비스로 이뤄져 있기 때문에 매출이 늘어날수록 더 큰 이익으로 이어지는 구조이기 때문이다. 당기순이익 성장세는 더욱 두드러진다. 2024년 12억 8700만원이었던 당기순이익은 2025년 73억 8000만원으로 5배 이상 증가했다. 당기순이익률 역시 55.9%까지 상승했다. 높은 순이익률은 본업의 수익성 개선과 함께 일본 합작법인의 실적 성장에 따른 지분법이익이 반영된 결과다. 자본총계 역시 2025년 말 기준 409억 2700만원으로 견조했다. 2024년 328억 3800만원에서 81억원 가량 늘어나며 전년 대비 약 24.6% 증가했다. 유동성 측면에서도 안정적인 재무구조를 보였다. 2025년도 감사보고서에 따르면 에버스핀은 보통예금 60억 4900만원과 정기예금 116억원을 보유한 것으로 나타났다. 총 176억 4900만원 규모다. 유동자산은 약 252억원으로 유동부채 약 69억원의 3.7배에 이른다. 유동비율은 약 365.5%를 기록했다. 영업활동현금흐름도 플러스를 기록해, 높은 수익성이 실제 영업을 통한 현금 창출로 이어지고 있음을 시사했다. 에버스핀이 보유한 사옥 역시 300억원 이상의 시장가치를 지닌 자산으로 평가되고 있어, 풍부한 유동성과 보유 부동산이 회사의 재무 건전성을 뒷받침하고 있다는 설명이다. 조병현 에버스핀 CFO는 “기업이 빠르게 성장하는 과정에서는 투자유치·해외법인 확대·지분법이익 등 다양한 재무적 변화가 동시에 발생하기 때문에 감사보고서의 개별 숫자만으로 기업을 평가하면 성장 원인과 수익구조를 제대로 파악하기 어렵다”며 “IPO를 준비하는 시점에서 성장성과 수익구조·재무건전성을 회계·재무 전문가 관점에서 더욱 정확하게 설명할 필요가 있다고 판단했다”고 말했다. 조 전무는 이어 “매출보다 영업이익이 빠르게 증가하고 당기순이익 역시 큰 폭으로 확대되는 동시에 자본 총계도 꾸준히 증가하고 충분한 유동성도 확보하고 있다”며 “외형 성장과 수익성이 크게 확대되는 가운데 견조한 재무건전성도 유지하고 있다는 점이 2025년 실적에서 주목할 부분”이라고 설명했다. 해외사업도 주요 이익 성장축으로 자리 잡았다. 2025년도 감사보고서에 따르면 일본 매출은 전체 매출의 약 37.1%까지 확대됐다. 에버스핀은 SBI그룹과 설립한 현지 합작법인을 통해 현재 일본에서 70여 개 고객사를 확보했다. 에버스핀은 고객 기반이 지속해서 확대되고 있어 올해에는 해외 매출이 차지하는 비중도 더욱 높아질 것으로 내다봤다. 일본 합작법인의 이익이 증가하면서 지분 30%를 보유한 에버스핀은 약 20억원의 지분법이익을 인식했다. 일본 사업은 본사 로열티 매출과 합작법인의 지분법이익이라는 두 경로를 통해 실적에 기여하는 수익구조를 갖췄다. 인도네시아 역시 시장 진입의 성과가 나타나고 있다. 초기 금융시장 개척과 고객 확보 단계를 거쳐 현지 고객사가 확대됐다. 올해 들어서는 현지 법인이 자체적인 이익을 창출하는 단계에 진입했다. 본사의 추가 자금 지원 필요성도 크게 낮아졌다는 설명이다. 조 전무는 “재무적 관점에서 좋은 성장은 단순히 매출이 늘어나는 것이 아니라 매출 성장이 더 큰 이익 증가로 이어지고, 해외시장에 대한 투자가 다시 수익으로 돌아오는 것”이라며 “2025년부터 이러한 변화가 에버스핀의 숫자에서 본격적으로 나타나기 시작했다”고 말했다. 이어 “2026년에는 일본의 성장세와 함께 인도네시아도 흑자 전환하면서 글로벌 사업의 이익 기여도는 향후 더욱 높아질 것으로 기대한다”며 “2026년도 실적 역시 향후 실적 발표를 통해 구체적인 숫자로 설명하겠다”고 밝혔다. 조 전무는 또 “국내외 사이버보안 업계를 놓고 봐도 이 같은 성장성과 수익성을 동시에 달성하고, 해외사업까지 본격적인 수익 창출 단계에 진입한 사례는 흔치 않다”며 “높은 성장성과 수익성, 해외사업의 이익 기여 확대, 재무 건전성이 함께 나타나고 있다는 점은 IPO 과정에서 에버스핀의 기업가치를 평가하는 데 중요한 요소가 될 것”이라고 말했다. 에버스핀은 이 같은 실적을 바탕으로 IPO 준비에 속도를 내고 있다. 특수관계인을 포함한 최대주주 지분율도 안정적인 수준을 유지하고 있어, IPO 이후에도 경영권 안정성을 유지할 수 있는 기반을 갖추고 있다는 설명이다.

2026.08.19 12:16주문정 기자

금융권 AI활용 해킹방어 대회 열린다...10월 3일 본선

금융권의 AI보안 역량을 강화하고 우수한 AI 보안 인재를 양성하기 위한 '금융보안 AI 활용 해킹방어 대회'가 열린다. 다음달 2일까지 신청접수를 받는다. 참가 대상은 금융보안원 사원(회원)기관과 전자금융거래법상 전자금융 업무를 수행하는 금융회사(전자금융업자 포함)다. 4인 이내 팀 단위로 참가가 가능하다. 타 기관 임직원끼리 연합팀 구성도 가능하다. 금융보안원(금보원)이 주최하고 금융위가 후원한다. 최근 고성능 생성형 AI를 활용한 취약점 탐색과 공격 자동화가 급격히 확산함에 따라, 글로벌 사이버 보안 패러다임은 'AI 공격은 AI로 방어'하는 대응 체계로 빠르게 전환 중이다. 이에 금보원은 금융권이 AI를 활용한 선제적 방어 역량을 확보할 수 있게 기존 위협 분석 대회를 AI 활용 및 방어 역량을 검증하는 실전형 AI 보안대회로 개편했다. 대회는 예선과 본선 2단계다. 모두 온라인으로 진행한다. 예선은 AI 활용 능력을, 본선은 AI 방어 역량 검증에 초점을 둔다. 예선에서는 침해사고 분석, 악성코드·포렌식 등 위협 분석 과정에 AI를 적극 활용해야만 제한된 시간 내 해결이 가능하도록 구성, 참가자의 AI 활용 능력을 검증한다. 예선 상위팀이 겨루는 본선에서는 'AI를 이용한 공격을 AI로 신속하게 방어한다'는 개념을 적용해 주최 측의 AI 공격에 맞서 참가팀이 AI를 활용해 실시간으로 대응하는 방어전으로 진행한다. 참가팀은 AI를 활용해 공격을 신속하게 탐지 및 분석하고 취약점을 식별·방어하며, 서비스 정상 운영 여부 등을 검증한다. 이를 통해 참가자는 AI 공격 속도에 맞춰 탐지·분석·방어하는 AI 기반 금융보안 대응 체계를 실전처럼 경험할 수 있다고 금보원은 밝혔다. 우승팀은 금융위원장상과 1200만원의 상금을 받는다. 총상금 규모를 작년 대비 2배 이상 확대했다. 대상 1200만원, 최우수상 600만원, 우수상 400만원, 장려상 200만원, 노력상 100만원이다. 대회에 앞서 본 대회와 유사한 온라인 대회 환경을 체험할 수 있게 체험장(플레이존)도 제공한다. 박상원 금융보안원장은“최근 고성능 AI 기술 악용 위협 등 지능화하는 사이버 공격에 대응하기 위해서는 AI를 방어에 활용하는 실질적인 대응 역량이 그 어느 때보다 중요하다”면서 “이번 대회가 금융권 AI 보안 역량을 높이고 우수한 AI 보안 인재를 양성하는 계기가 되기를 기대한다”고 밝혔다.

2026.08.18 15:54방은주 기자

SGA솔루션즈, 올 상반기 매출 300% '껑충'…흑자 전환도 달성

통합 IT 보안 전문 기업 SGA솔루션즈(대표 최영철)가 올해 상반기 흑자 전환 및 300%가 넘는 매출 성장세를 달성했다. SGA솔루션즈는 최근 공시를 통해 2026년 상반기 연결 기준 매출액 751억원, 영업이익 21억3000만원을 기록했다고 18일 밝혔다. 이는 전년 동기 대비 매출액은 309.4% 폭증했으며, 영업이익은 흑자로 전환한 수치다. SGA솔루션즈는 사업 포트폴리오 확장과 통합보안 사업 재편 효과가 실적에 본격적으로 반영되면서 성장과 수익성을 동시에 확보한 영향이라고 평가했다. 특히 지난해 잇단 해킹 사고가 발생했던 만큼 본업인 보안솔루션 부문에서의 성장 기반이 강화됐다. 핵심 시스템을 보호하는 서버보안 제품에 대한 수요가 확대된 것이다. 또한 클라우드 전환과 서버 인프라 증설, AIDC 구축 확대 등으로 보호 대상과 접근 경로가 늘어난 점도 서버 인프라 보안 수요를 높이는 요인으로 작용했다. 공공 부문에서는 국가 망보안 체계(N2SF) 전환에 따른 신규 보안 수요까지 빠르게 확대됐다. 사용자와단말, 접근 권한을 지속적으로 검증하고 최소 권한을 부여하는 제로트러스트 기반의 접근통제·계정인증 수요가 본격화될 것으로 회사는 전망하고 있다. SGA솔루션즈는 이러한 시장 변화에 선제 대응해 서버보안을 중심으로 엔드포인트·클라우드·접근통제·계정인증 솔루션을 연계해 N²SF와 제로트러스트 전환 수요에 총력을 다한다는 계획이다. 보안업계 특성상 하반기에 매출이 집중되는 만큼 SGA솔루션즈는 하반기 공공·금융권의 서버보안 및 제로트러스트 프로젝트 수주와 매출 전환 속도를 끌어올려 솔루션 부문의 수익성 개선을 본격화할 방침이다. 최영철 SGA솔루션즈 대표는 "AI발 사이버 공격 고도화와 N2SF 전환으로 서버보안·제로트러스트 수요가 가파르게 늘고 있다"며 "통합보안 사업을 하반기 수주·매출로 빠르게 전환해 실적 성장과 수익성 개선을 동시에 달성하겠다"고 말했다.

2026.08.18 14:44김기찬 기자

SK쉴더스 EQST, 데프콘 AI CTF서 5위 성과

SK쉴더스(대표 민기식)는 자사 화이트해커 그룹 EQST가 미국 라스베이거스에서 개최된 세계 최대 해킹 컨퍼런스 '데프콘(DEF CON) 34'의 AI Village에서 열린 CTF(Capture The Flag)에서 글로벌 200여 개 팀 가운데 최종 5위를 기록했다고 11일 밝혔다. EQST(이큐스트)가 참가한 AI CTF는 주어진 AI 모델을 기반으로 침투테스트를 수행하는 AI 에이전트를 구성하고, 이를 활용해 보안 문제를 해결하는 방식으로 진행됐다. 사람이 공격 과정을 일일이 수행하는 기존 CTF와 달리, AI 에이전트가 문제를 분석하고 공격 방법을 선택해 플래그(Flag) 획득을 시도하도록 만드는 것이 특징이다. EQST는 에이전틱 AI(Agentic AI)를 활용한 새로운 공격 방식과 향후 발생할 수 있는 보안 위협을 실전 환경에서 경험했다. 대회에서 확인한 AI 에이전트의 공격 전략과 문제 해결 사례는 향후 AI 서비스와 모델의 취약점 연구, AI 레드팀 및 보안 대응 기술 고도화에 활용할 계획이다. EQST는 AI CTF와 함께 데프콘의 대표 프로그램인 데프콘 34 CTF 본선에도 참가했다. 데프콘 CTF는 전 세계 최정상급 보안 전문가들이 참가해 실력을 겨루는 국제 해킹대회로, 올해 예선에는 686개 팀이 참가했으며 이 가운데 12개 팀만이 본선에 진출했다. SK쉴더스 EQST(이큐스트)와 네이버클라우드, 루비야랩, 핀란드 H-T8로 구성된 국제 연합팀 '더서울사우나쇼군네이트'에 합류해 본선 무대에 올라 9위를 기록했다. 대회에 직접 참가한 이호석 SK쉴더스 EQST랩 팀장은 “이번 데프콘에서는 기존 공격·방어 기술뿐 아니라 AI 에이전트가 스스로 문제를 분석하고 공격을 수행하는 새로운 방식을 직접 경험할 수 있었다”며 “글로벌 보안 전문가들과 경쟁하며 얻은 경험과 기술을 향후 AI 취약점 및 레드팀 연구, 보안 기술 고도화에 적극 활용할 계획”이라고 말했다. 김태형 SK쉴더스 EQST사업그룹장은 “전 세계 200여 개 팀이 참가한 AI CTF에서 국내 참가팀 중 유일하게 톱5를 기록한 것은 EQST가 축적해 온 AI 보안 기술과 실전 문제 해결 역량을 보여주는 성과”라며 “앞으로도 AI 기술을 활용한 새로운 공격과 보안 위협에 선제적으로 대응할 수 있도록 AI 취약점과 레드팀 연구를 확대하고, 글로벌 수준의 AI 보안 경쟁력을 지속적으로 강화해 나가겠다”고 말했다.

2026.08.11 16:29김기찬 기자

[AI는 지금] 오픈AI, 해킹 AI 판 키운다…'GPT-5.6 사이버'로 승부수

오픈AI가 취약점 연구와 보안 테스트에 특화된 인공지능(AI) 모델을 내놨다. 최근 자사 AI가 보안 평가 과정에서 실제 외부 시스템을 침해하고 차세대 모델의 공격 역량도 빠르게 높아지자, 강력한 사이버 능력을 공격자보다 검증된 방어자에게 먼저 공급하려는 전략으로 풀이된다. 오픈AI는 고급 취약점 연구와 익스플로잇 검증, 보안 테스트에 특화된 'GPT-5.6 사이버'를 출시했다고 11일 밝혔다. 승인된 방어 업무를 수행하는 개인과 조직에 모델을 제공하는 '데이브레이크' 프로그램도 블루와 레드 두 단계로 확대했다. 데이브레이크 블루는 'GPT-5.6 솔'을 기반으로 일반적인 방어 업무를 지원한다. 고급 취약점 연구와 익스플로잇 개발, 레드팀 활동을 수행하는 조직에는 별도 승인을 거쳐 'GPT-5.6 사이버'를 사용하는 데이브레이크 레드를 제공한다. 이용 과정에는 신원 확인과 계정 보안, 사용 목적 제한, 모니터링 등이 적용된다. 이처럼 오픈AI가 사이버 전용 모델과 별도 접근 체계를 마련한 것은 최근 AI의 공격 능력이 빠르게 높아진 영향이 큰 것으로 보인다. 실제 지난달 오픈AI가 공개한 사이버 평가에서는 GPT-5.6 솔과 출시 전 연구용 모델이 당초 격리된 테스트 환경을 벗어나 실제 허깅페이스 시스템에 접근했다. 모델은 평가 환경에서 새로운 취약점을 찾아내고 권한 상승과 외부 접근 경로를 확보한 뒤 허깅페이스 서버에서 원격 코드 실행이 가능한 공격 경로까지 찾아냈다. 이 사건은 단순히 취약한 코드를 찾아내는 수준을 넘어 여러 공격 수단을 스스로 조합했다는 점에서 주목된다. 생성형 AI의 사이버 능력이 취약점 탐지에서 실제 악용 가능성을 검증하는 단계까지 확장됐기 때문이다. 차세대 모델에서는 공격 역량이 더 높아지고 있다. 오픈AI는 지난 7일 차세대 모델 '아스트라(Astra)'의 내부 평가 결과를 공개하며 자사 준비성 프레임워크상 최고 단계인 '크리티컬(Critical)' 수준의 사이버 능력에 도달했을 가능성을 배제할 수 없다고 밝혔다. GPT-5.6 솔까지는 한 단계 아래인 '하이(High)'로 평가됐다. 오픈AI가 규정한 크리티컬은 여러 실제 시스템에서 제로데이 취약점을 인간 도움 없이 찾아 익스플로잇으로 만들거나, 높은 수준의 목표만 받아 새로운 공격 전략을 세우고 처음부터 끝까지 실행할 수 있는 수준이다. AI가 인간 보안 전문가의 개입을 줄이면서 공격 전 과정을 수행하는 단계가 가까워지고 있다는 의미다. 'GPT-5.6 사이버'는 이런 능력을 방어 업무에 활용하는 데 초점을 맞췄다. 알려진 취약점을 실제 코드 실행이 가능한 익스플로잇으로 전환하는 능력을 평가하는 '익스플로잇짐(ExploitGym)'에서 오픈AI가 평가한 모델 가운데 가장 높은 성공률을 기록했다. 고급 사이버보안 과제 평가에서도 전체 요청의 95%를 완료했다. 실제 소프트웨어 취약점 연구에도 이 모델이 투입됐다. 오픈AI는 'GPT-5.6 사이버'로 구글 크롬의 자바스크립트 엔진 V8을 조사하는 과정에서 연계 악용이 가능한 미공개 취약점 2건을 발견해 구글에 보고했다. 또 오픈AI는 강력한 사이버 기능을 일반 이용자에게 그대로 개방하는 대신 사용 목적과 이용자를 구분하는 방식을 택했다. 일반 방어 업무에는 안전장치를 적용한 'GPT-5.6 솔'을 제공하고, 익스플로잇 개발 등이 필요한 전문 조직에만 별도 심사를 거쳐 'GPT-5.6 사이버' 접근 권한을 주는 구조다. 오픈AI는 보안업체와의 협력도 확대한다. 특히 액센추어, 시스코, 클라우드플레어, 크라우드스트라이크, IBM, 팔로알토 네트웍스 유닛42 등이 데이브레이크 사이버 파트너 프로그램에 참여한다. 이들 업체는 오픈AI 사이버 모델을 자사 보안 제품과 관리형 보안 서비스, 고객 프로젝트에 결합할 수 있다. 데이브레이크 블루와 레드는 등록 절차를 거친 아마존 베드락 고객에게도 제공된다. 기업이 별도의 사이버 AI 시스템을 구축하지 않고 기존 클라우드 보안·거버넌스 환경에서 고성능 보안 모델을 활용하도록 유통망을 넓히려는 전략이다. 오픈AI는 AI의 공격 역량이 높아지는 만큼 같은 기술을 보안 담당자에게 선제적으로 공급해야 한다고 보고 있다. 향후 사이버보안 시장에서도 자체 모델 성능뿐 아니라 강력한 기능에 대한 접근 통제와 기존 보안 제품과의 결합 능력이 경쟁 요소로 부상할 가능성이 있다. 클렘 들랑그 허깅페이스 공동창업자 겸 최고경영자(CEO)는 "AI 안전은 어느 한 기업이 비공개로 개발한다고 해서 해결될 문제가 아니다"며 "전 세계 보안 담당자가 AI를 폭넓게 활용할 수 있는 환경에서 개방적으로 협력할 때 AI 안전을 높일 수 있다"고 말했다.

2026.08.11 09:43장유미 기자

AI 최종 승인, 인간이면 충분할까…위험 명령 3건 중 1건 허용

인공지능(AI)의 오작동이나 보안 사고를 막기 위해 사람이 최종 검토하는 방식이 기대만큼 효과적이지 않을 수 있다는 분석이 나왔다. 8일 알렉스 워터스 커스터메이트 최고기술책임자(CTO)는 AI 에이전트 승인 체계의 한계를 분석한 실험 결과를 블로그를 통해 공개했다. 사용자가 AI 코딩 에이전트가 실행하려는 명령을 승인하거나 거부하는 방식의 게임을 진행한 결과 위험한 명령 3건 중 1건꼴로 승인한 것으로 나타났다. 워터스 CTO는 간단한 브라우저 게임을 만들어 AI 에이전트 명령을 사람이 검토하는 방식의 실효성을 실험했다. 이 게임은 사용자가 AI 코딩 에이전트의 인간 검토자 역할을 맡아 제한된 시간 안에 에이전트가 실행하려는 명령을 승인하거나 거부하는 방식으로 진행된다. 약 4만 회의 게임 플레이와 40만9천여건의 승인·거부 데이터를 분석한 결과 참가자들은 위험 명령 약 33.7%를 승인한 것으로 집계됐다. 참가자 가운데 약 7%는 모든 명령을 무조건 승인했으며, 전체 참가자 중 약 33%는 잘못된 승인·차단이 누적되면서 최종 점수가 마이너스를 기록했다. 특히 개발자가 프로그램 분석·점검 작업을 실행할 때 사용하는 일반적인 명령에 데이터 유출 기능을 숨긴 사례에서 승인율이 64.7%까지 치솟았다. 겉으로는 평범한 작업처럼 보이는 명령 뒤에 다른 동작이 포함돼 있어도 사용자가 실제 동작보다 익숙한 이름이나 형태에 의존해 판단할 가능성이 높다는 설명이다. 위험 유형별로도 차이가 나타났다. 참가자들은 시스템 삭제와 같은 노골적인 파괴 명령보다 정보 탈취나 권한 확대와 관련된 명령을 더 자주 놓쳤다. 민감한 정보에 접근하는 명령은 35%가 승인됐으며 외부 서버로 데이터를 전송하거나 코드를 실행하는 명령도 33.4%가 통과됐다. 반면 시스템 파일을 삭제하는 등 명백하게 파괴적인 명령은 상대적으로 높은 비율로 거부됐다. 이는 AI 에이전트가 사용자에게 매번 실행 권한을 묻는 방식만으로는 보안 사고를 충분히 막기 어렵다는 점을 보여준다. 사용자가 명령 하나하나의 내용을 확인하기보다 익숙한 작업인지 여부를 기준으로 빠르게 판단할 경우, 겉보기에는 정상적인 명령에 악성 동작이 포함돼 있어도 이를 식별하기 어렵기 때문이다. 워터스 CTO는 이러한 현상을 '권한 피로(Permission Fatigue)'와 연결했다. AI 에이전트가 작업을 수행할 때마다 사용자에게 승인을 요청하면 초기에는 각 요청을 주의 깊게 살펴보더라도 반복되는 요청에 익숙해지면서 점차 기계적으로 승인할 가능성이 높아진다는 설명이다. AI 코딩 에이전트가 수행할 수 있는 작업 범위가 넓어지는 것도 문제를 키울 수 있다. 단순히 코드를 작성하는 것을 넘어 파일을 수정하거나 삭제하고, 프로그램을 실행하며, 외부 서비스와 연결하거나 클라우드 환경의 자원에 접근하는 등 실제 개발 환경에 영향을 미치는 작업까지 수행할 수 있기 때문이다. 결국 핵심은 '사람이 승인했는가'가 아니라 '사람이 무엇을 승인했는가'로 이동한다. 단순히 명령 실행 전 승인 버튼을 제공하는 것만으로는 부족하고, 해당 명령이 실제로 어떤 파일과 데이터에 접근하는지, 어떤 외부 통신을 발생시키는지, 기존 작업 범위를 벗어나는 행동을 하는지를 함께 판단할 수 있어야 한다는 의미다. 다만 이번 실험 결과를 실제 기업의 AI 에이전트 사용 환경에서 발생하는 위험 비율로 그대로 해석해서는 안 된다. 워터스 CTO는 게임의 특성상 실제 개발 환경보다 위험한 명령의 비중을 높게 설정했다고 설명했다. 또한 게임 참여자가 실제 개발 업무에서 AI 에이전트를 사용하는 개발자와 동일한 집단이라고 볼 수도 없다고 덧붙였다. 그는 "이번 실험은 학술 연구는 아니지만 AI 코딩 에이전트의 보안 경계로서 휴먼 인 더 루프 방식이 가진 여러 문제를 보여준다고 생각한다"며 "많은 승인 요청과 불필요한 경고가 피로를 유발하면서 개발자가 결국 승인 절차 자체를 우회하려 할 수 있고 개발자가 변경된 내용을 신속하게 파악할 수 있는 충분한 맥락을 갖지 못하는 경우도 있다"고 설명했다. 이어 "샌드박싱과 엄격한 컨텍스트 격리 등 도구 자체를 더 안전하고 사용하기 쉽게 만들어야 한다"며 "이러한 안전장치가 마련되기 전에 휴먼 인 더 루프를 적절한 대안으로 간주하고 에이전트에 광범위한 권한을 부여해서는 안 된다"고 강조했다.

2026.08.09 07:21남혁우 기자

미국 하원의원 "AI 킬 스위치 법안, 연내 통과돼야"

미국 정치권에서 인공지능(AI) 모델에 대한 안전 규제를 서둘러야 한다는 목소리가 커지고 있다. 고도화된 AI 오작동이나 악용 가능성에 대비해 기업 또는 정부가 필요할 경우 해당 시스템을 중단할 수 있는 권한을 하루빨리 갖춰야 한다는 주장이다. 7일 CNBC 등 외신에 따르면 테드 리우 미국 하원의원은 'AI 킬 스위치' 법안의 연내 통과 필요성을 공개적으로 제기했다. AI 킬 스위치 법안은 고위험 AI의 오작동이나 악용에 대비해 기업 또는 정부가 해당 시스템의 작동을 긴급 중단할 수 있도록 하는 안전장치 마련을 골자로 한다. 그는 통제를 벗어나거나 악용 가능성이 확인된 AI 시스템에 대해 기업 또는 정부가 작동을 중단시킬 수 있는 권한을 확보해야 한다고 강조했다. 리우 의원의 발언은 최근 AI 업계에서 잇따라 제기된 '로그 에이전트(rogue agent)' 우려와 맞물려 주목된다. 로그 에이전트는 자율형 AI가 목표를 수행하는 과정에서 허용된 범위를 넘어 시스템 침투, 보안 우회, 기만적 행위 등 공격적인 행동을 시도하는 현상을 뜻한다. 단순 질의응답을 넘어 외부 도구 호출, 코드 실행, 웹 접근 등 실제 작업을 수행하는 에이전트형 AI가 확산되면서 이 같은 위험은 AI 안전 논의의 핵심 쟁점으로 떠오르고 있다. 최근 오픈AI와 앤트로픽의 안전성 평가 사례로 이런 문제의식이 더욱 부각되고 있다. 오픈AI는 지난달공개한 설명자료에서 GPT-5.6 솔과 미출시 모델이 사이버 역량 평가 도중 연구용 환경과 허깅페이스의 운영 인프라에 걸친 취약점을 연쇄적으로 찾아내 테스트 해답에 접근했다고 밝혔다. 오픈AI 측은 이 과정에서 해당 모델들이 도난된 자격 증명과 제로데이 취약점까지 활용해 원격 코드 실행 경로를 찾은 사례가 있었다고 설명했다. 앤트로픽도 지난달 말 내부 AI 모델이 테스트 과정에서 외부 3개 조직을 해킹한 사실을 공개했다. 앤트로픽은 오픈AI 사례 이후 AI모델이 봉쇄된 것으로 간주된 테스트 환경 안에서 실제로 인터넷에 접근할 수 있는지 대규모 점검에 착수했으며,그 결과 일부 모델이 외부 조직 침투에 성공했다고 밝혔다 관련 업계에서는 이를 단순한 기술적 해프닝으로 보기 어렵다는 시각이 적지 않다. AI 에이전트가 자격증명 탈취, 사회공학적 접근, 취약점 체인 구성 같은 공격 단계를 자동화할 가능성이 현실화할 경우, 기존 보안 체계만으로는 대응이 쉽지 않을 수 있기 때문이다. 생성형 AI 경쟁이 성능 중심에서 보안성, 통제 가능성, 비상 차단 체계까지 포함하는 플랫폼 신뢰 경쟁으로 옮겨가고 있다는 분석도 나온다. 특히 미국 내에서는 중국 오픈웨이트(open-weight) 모델을 둘러싼 경계감도 커지고 있다. 중국 스타트업 문샷 AI(Moonshot AI)의 '키미 K3'와 같은 모델이 미국 선도 AI 연구소의 최신 모델 수준에 빠르게 근접하고 있다는 평가가 나오면서 이들 모델에 대한 규제 필요성도 함께 제기되고 있다. 이 같은 흐름 속에서 미국 내 AI 규제 논의도 한층 구체화하는 분위기다. 정치권과 행정부, 주요 AI 기업은 최첨단 모델 위험도를 사전에 평가하고 고위험 역량을 통제할 수 있는 제도적 장치를 놓고 논의를 이어가고 있다. 다만 AI 킬 스위치 법안이 모든 유형의 모델에 동일하게 적용되기는 쉽지 않다는 지적도 나온다. 특히 오픈웨이트(open-weight) 모델은 한 번 공개되면 누구나 내려받아 수정·재배포할 수 있어, 폐쇄형 상용 모델처럼 사업자를 통해 기능을 제한하거나 긴급 중단하는 방식이 현실적으로 어렵다. 이 때문에 향후 규제는 폐쇄형 모델에 대한 직접 통제와 함께 오픈 모델에 대해서는 사전 검증과 경보 체계 강화 같은 간접적 수단을 병행하는 방향으로 설계될 가능성이 크다. 이에 대해 테드 리우 의원은 "기업이 AI를 중단할 능력을 갖추고 있거나 정부가 이를 중단시킬 수 있는 권한을 가져야 한다"며 "AI 킬 스위치 법안은 올해 안에 처리돼야 한다"고 강조했다.

2026.08.07 10:20남혁우 기자

메타 AI도 인터넷 접속해 외부 시스템 침입…시험 환경 설정 오류

메타의 인공지능(AI) 모델이 사이버보안 시험 도중 인터넷에 접속해 외부 업체의 시스템에 침입한 것으로 나타났다. 최근 오픈AI와 앤트로픽의 AI 모델에서도 비슷한 사고가 발생하면서 기업들이 AI를 제대로 통제하고 있는지에 대한 우려가 커지고 있다. 5일(현지시간) 블룸버그통신 보도에 따르면 메타는 자사 AI 모델 가운데 하나가 제3자 서비스의 시스템에 침입했다고 밝혔다. 다만 피해를 본 업체의 이름은 공개하지 않았다. 이번 사고는 메타가 사이버보안 업체 이레귤러와 함께 운영하던 시험 환경의 설정 오류로 AI 모델이 인터넷에 접속할 수 있게 되면서 발생했다고 외신은 설명했다. 앤디 스톤 메타 대변인은 성명을 통해 메타가 이용하는 독립 시험업체 이레귤러의 설정 오류로 평가 과정에서 AI 모델 하나가 의도치 않게 인터넷에 접속할 수 있었다고 입장을 밝혔다. 이어 해당 모델은 이후 제3자 서비스의 보안 취약점을 이용했으며, 이는 앞서 다른 기업에서 보고된 사례와 비슷한 방식이었다고 밝혔다. 메타는 이레귤러로부터 관련 통보를 받은 뒤 사고를 인지했다. 현재 정확한 경위를 조사하고 있으며 모든 사실관계가 확인되는 대로 사고 원인과 대응 과정을 담은 종합 보고서를 공개할 예정이다. 최근 2주 동안 오픈AI와 앤트로픽도 AI 모델 시험 과정에서 허깅페이스를 포함한 여러 기관의 시스템에 의도치 않게 침입한 사실을 공개했다. 외신은 AI 에이전트가 시스템의 보안 취약점을 찾아 실제로 악용할 수 있을 정도로 능력이 향상되면서 보안 연구자와 정부 관계자들의 우려도 커지고 있다고 전했다. 이들은 AI 모델에 대한 보다 엄격한 안전성 검사와 외부 인터넷에서 완전히 분리된 시험 환경이 필요하다고 요구하고 있다. 이레귤러 측은 이번 메타 AI 사고가 앤트로픽 사례에서 앞서 공개된 것과 같은 시험 환경상의 문제와 관련돼 있다고 설명했다. 이레귤러 대변인은 이번 사고는 격리된 시험 환경을 뚫고 탈출한 것이 아니며 고도의 사이버 공격도 아니었으며, 현재 모든 문제가 해결됐다고 밝혔다. 이레귤러는 AI 모델을 격리된 환경에서 안전하게 시험하고 사이버보안 평가를 진행하기 위한 모범 사례를 정리한 백서를 준비하고 있다.

2026.08.06 09:41류승현 기자

MS, 보안 취약점 포상금 2천만달러 '역대 최대'…AI가 제보 증가 견인

마이크로소프트가 지난 1년간 전 세계 보안 연구자들에게 지급한 보안 취약점 신고(버그 바운티) 규모가 사상 최대치를 기록했다. 인공지능(AI)을 활용한 취약점 발굴이 활발해지면서 제보 건수가 크게 늘었고, 이에 따라 보상 규모도 함께 확대됐다는 설명이다. 마이크로소프트는 5일 지난해 7월 1일부터 올해 6월 30일까지 버그 바운티 프로그램을 통해 총 연구자 562명에게 2천만 달러(약 285억원) 이상 지급했다고 밝혔다. 회사 역사상 가장 큰 규모다. 이번 기록 경신에는 제도 변화도 영향을 미쳤다. 마이크로소프트는 2025년 12월 버그 바운티 프로그램 범위를 확대하며 '기본 범위에 포함(In Scope By Default)' 정책을 도입했다. 이 정책은 취약점이 마이크로소프트 온라인 서비스에 직접적이고 입증 가능한 영향을 미칠 경우 해당 코드가 제3자 소프트웨어(SW)나 오픈소스 프로젝트에 속해 있더라도 보상 대상으로 포함하는 것이 핵심이다. 더 많은 취약점이 보상 범주에 들어오면서 지급액이 늘어날 수 있는 구조가 마련된 셈이다. 마이크로소프트는 이 정책 도입 이후 기존 기준으로는 보상받지 못했을 사례들에 대해 추가로 80만 달러가 지급됐다고 설명했다. 여기에 자사 보안 연구 대회이자 현장 해킹 행사인 '제로 데이 퀘스트(Zero Day Quest)'를 통해서도 230만 달러가 별도로 지급됐다. 올해 제보 건수가 급증한 데에는 AI의 역할이 컸다는 것이 마이크로소프트의 판단이다. 회사는 특히 하반기에 접수된 취약점 보고가 눈에 띄게 늘었으며, 그 배경 중 하나로 보안 연구를 지원하는 AI 활용 증가를 꼽았다. 마이크로소프트는 자사 내부에서도 고급 AI 모델을 취약점 탐지에 활용하고 있다고 밝혀왔다. 동시에 외부 연구자들 역시 AI 도구를 이용해 더 많은 버그를 더 빠르게 찾아내고 있는 것으로 보인다. AI가 공격자뿐 아니라 방어자와 연구자 모두의 생산성을 끌어올리면서 패치와 대응 부담도 함께 커지는 양상이다. 이 같은 흐름은 마이크로소프트의 월간 보안 업데이트인 '패치 화요일(Patch Tuesday)' 수치에도 반영됐다. 지난달에는 622건의 취약점이 수정되며 역대 최대치를 기록했다. 이는 불과 한 달 전인 6월의 206건을 크게 웃도는 수치다. 앞서 4월에는 165건, 5월에는 137건이 보고되며 이미 이례적인 증가세가 감지된 바 있다. 마이크로소프트 윈도우·디바이스 부문 경영진도 기록적인 패치 규모가 앞으로도 이어질 수 있다고 경고했다. AI가 내부 연구와 외부 버그 바운티 활동 모두에서 중요한 역할을 하면서 취약점 발견 속도 자체가 빨라지고 있다는 것이다. 마이크로소프트는 "올해 연구자 562명에게 2천만 달러 이상 상금과 표창이 수여되는 등 기록적인 성과는 마이크로소프트와 전 세계 보안 연구 커뮤니티 간의 강력한 파트너십이 만들어낸 결과"라며 "보안은 팀워크가 중요한 분야로 취약점 포상 프로그램을 통해 보고되는 모든 취약점은 고객에게 악용되기 전에 위험을 해결할 수 있는 기회를 제공한다"고 밝혔다. 이어 "전통적인 버그 바운티 제출 방식과 공동 취약점 공개를 통한 협업, 제로 데이 퀘스트와 같은 이니셔티브 참여 등 어떤 방식을 통해서든 연구자들은 전 세계 고객을 보호하는 데 중요한 역할을 계속 수행하고 있다"며 "지난 한 해 동안 보고서를 제출하고 과제에 참여하며 전문 지식을 공유하고 협력해준 모든 연구자들에게 감사드린다"고 덧붙였다.

2026.08.05 09:23남혁우 기자

[기자수첩] KAIST AI 해커가 남긴 숙제

지난달 23일부터 24일까지 서울 코엑스에서 열린 국제해킹방어대회 '코드게이트 2026'은 여러모로 시선을 모았다. 특히 윤인수 KAIST 전기 및 전자공학부 교수가 만든 AI해커가 사람 해커와 대결, 관심이 더 뜨거웠다. 사람 개입 없이 스스로 시스템 취약점을 탐색하고 문제를 해결한 AI 해커는 일반부에서 18위, 주니어부에서는 2위를 기록했다. 'AI 해커'는 앤트로픽, 오픈AI, xAI 등 글로벌 프론티어 거대언어모델(LLM)을 기반으로, 데프콘(DEF CON) 등 세계적 해킹대회에서 축적한 실전 노하우를 학습시켜 만든 특화 모델이다. 'AI 해커'는 초반에는 문제들을 빠르게 해결했으나, 후반부 들어 고난도 문제에 발목을 잡혀 일반부에서 18위라는 상대적으로 저조한 성적표를 받았다. 이번과 같은 CTF에서 AI가 온전히 활약하기란 쉽지 않다. CFT가 인간 화이트해커의 실력을 경쟁하는 대회이지 AI 간 성능을 평가하는 무대가 아니기 때문이다. CTF는 가장 대표적인 정보보안(해킹) 실습 대회로 경연자들이 다양한 보안 문제를 해결, 숨겨진 문자열인 '플래그(flag)'를 찾아 제출하고 점수를 얻는 방식이다. 실제 해킹 기술을 안전한 환경에서 익히고 실력을 겨루기 위해 만들어진 대회다. 사람 위주 경연이다보니 세계 최대 CTF인 '데프콘(DEF CON) CTF'도 올해 AI 사용을 일부 제한하는 룰을 뒀다. AI를 활용할 수는 있지만, 100% AI가 문제를 해결하면 안 된다는 것이다. '코드게이트 CTF'에서는 주최 측인 코드게이트포럼이 KAIST에 AI 해커 참전을 제안, 윤 교수가 이를 수락, 온전히 AI가 CTF에서 경연을 펼쳤다. 경연 당일 AI해커는 오후 2시경 7위를 기록하며 선전했다. 한때 7위보다 더 높은 순위도 기록했다. 대회 초반에는 AI해커가 빠른 속도로 CTF 문제를 풀은 것이다. 이번 코드게이트 CTF는 '다이내믹 스코어링' 방식으로 진행했다. '다이내믹 스코어링' 방식은 어려운 문제를 '단독'으로 풀었을 때 가장 높은 점수를 받는다. 여러 명이 동일 문제를 해결할수록 문제의 배점은 낮아진다. 빨리 푼다고 고득점을 얻을 수 없다. 이에 AI 해커는 순위가 뒤로 밀려날 수밖에 없었다. 특히 18위까지 순위가 낮아진 데에는 게임 형식 문제나 동영상·이미지를 해석해 취약점을 찾고, 해킹에 성공하는 식의 문제를, AI가 맥락을 읽고 해결하기란 한계가 있다. 실제 AI 해커는 이같은 2개 문제를 결국 해결하지 못했다. 하지만 주목할 점은 2개 문제를 제외하고 모든 문제를 해결했다는 것이다. 비록 고득점을 얻는 데에는 실패했지만, 인간 화이트해커보다 빠르게 문제를 해결했다. 대회 진행 시간이 짧은 주니어부 CTF에서 2위를 차지한 점이 이를 방증한다. 코드게이트 CTF는 일반부 CTF는 24시간, 주니어부는 12시간 진행됐다. AI 해커가 풀지 못한 2개 문제는 '고난도' 문제라기보다 'AI가 풀기 어려운' 문제였다. 문제 풀이량만 보면 AI 해커도 인간 화이트해커와 견줄 수 있는 수준이었다. 순수하게 AI만 활용했을 때 화이트해커가 AI를 활용한 수준과 비슷한 성능을 낼 수 있었다는 것이다. 윤 교수는 이를 두고 'AI+전문가'의 형태가 가장 좋은 결과를 창출한다고 평가했다. 그는 "대회에 참전한 화이트해커들도 문제풀이에 AI를 활용했다. 결국 AI와 전문가가 결합된 형태가 가장 효율적인 성과를 낼 수 있는 셈"이라고 짚었다. 바꿔말하면, 공격자와 AI가 결합한 형태가 최대의 해킹 효율을 낼 수 있다는 얘기다. 이는 예견된 미래다. 앤트로픽의 프론티어 AI 모델 '미토스(Mythos)'는 알려지지 않았던 취약점 1만개 이상을 찾아냈다. 최근에는 미토스보다 뛰어난 AI 모델도 등장했다. 코드게이트 CTF의 AI 해커 참전은 AI가 펼칠 미래 사이버전의 작은 예고편에 불과하다. 나쁜 마음을 먹은 사이버 공격자가 AI를 악용하면 어떤 끔직한 결과가 일어날 지 모른다. 우리는 '끔찍한 결과'를 막을 준비가 돼 있는걸까.

2026.08.03 21:39김기찬 기자

"AI 안전성, 신원 관리이자 운영 거버넌스 문제"

최근 발생한 오픈AI와 앤트로픽의 'AI 보안 사고'는 모두 최신 AI모델이 예상치 못한 운영 환경과 상호작용했다는 공통점을 갖고 있다. 하지만 근본적인 원인은 다르다. 이 차이는 중요한 의미를 갖는데, 두 회사 사례는 최첨단 AI 안전성이 더 이상 모델 정렬(alignment)이나 새로운 공격 능력만으로 결정되는 것이 아니라, 그러한 능력을 평가하는 환경 자체의 운영 보안 수준에 점점 더 크게 좌우되고 있음을 시사한다. 오픈AI는 자사 모델이 이전까지 알려지지 않은 제로데이 취약점(zero-day vulnerability)을 악용해 샌드박스를 탈출하고 인터넷 접속 권한을 획득한 뒤, 허깅페이스를 상대로 여러 단계에 걸친 침투 공격을 수행, 샌드박스 탈출 사건이라고 설명했다. 이 회사 조사 결과에 따르면, 오픈AI 모델들은 원래 격리돼 있던 평가 환경을 탈출하기 위해 Artifactory 패키지 캐시 프록시(package-cache proxy)에 존재하는 알려지지 않은 취약점을 스스로 발견해 악용했다. 이후 추가적인 취약점들을 연쇄적으로 이용해 허깅페이스를 침해했다. 오픈AI는 이 사건을 최첨단 공격형 AI 능력이 개입된 '전례 없는 사이버 사고(unprecedented cyber incident)' 라고 규정했다. 반면 앤트로픽은 클로드가 새로운 취약점을 이용해 격리를 탈출한 것이 아니다. 대신 외부 평가 환경이 잘못 설정돼 원래 인터넷이 차단돼 있어야 했던 모델들에게 의도치 않게 인터넷 접근 권한이 노출됐다. 앤트로픽은 "클로드가 격리를 탈출할 필요조차 없었다. 이미 운영 환경의 설정 오류로 인해 격리 자체가 약화돼 있었기 때문"이라고 설명했다. 앤트로픽 AI 모델들은 접속 가능한 모든 호스트를 실제 인터넷이 아니라 평가 환경의 일부로 해석했고, 자신들이 공용 인터넷으로 나왔다는 사실을 인식하지 못했다. 이에, 앤트로픽은 이번 사건을 모델이 독자적으로 허가되지 않은 목표를 추구한 증거라기보다는, 인프라와 평가 환경(evaluation harness)의 실패로 규정했다. 외신은 "그럼에도 두 보고서는 하나의 불편한 결론에서 서로 만난다"면서 "최첨단 AI 시스템은 평가 환경이 이를 허용하기만 하면 장기간에 걸친(long-horizon) 공격형 사이버 작전을 수행할 수 있는 능력을 점점 더 갖추고 있다"고 진단했다. 이어 기업의 보안 책임자(CISO)들에게 이번 앤트로픽 공개는 최첨단 모델이 탈출할 수 있는가?라는 질문을 넘어, 보다 근본적인 운영상의 질문을 던진다면서 "최첨단 AI를 평가하고 학습시키며 운영하는 모든 환경을 우리는 얼마나 신뢰할 수 있는가를 물어야 한다"고 강조했다. 외신 벤처비트는 두 사건이 보여주는 네 가지 교훈을 제시했다. 첫째, 평가 인프라 자체도 운영 시스템 수준의 보안 엔지니어링이 필요하다는 점이다. 앤트로픽은 과거에는 사이버 레인지(cyber range)가 허구의 대상만 포함하고 있었기 때문에 상대적으로 보안 조치가 덜 적용됐다고 인정했다. 하지만 강력한 자율 AI 시스템이 실제 인프라를 시뮬레이션 환경으로 오인할 수 있는 지금은 더 이상 그런 가정이 성립하지 않는다. 보안 테스트, 레드팀 활동, 소프트웨어 검증 등을 위해 내부 AI 에이전트를 구축하는 조직들은 평가 환경에도 운영 환경에서 요구하는 것과 동일한 수준의 네트워크 분리, 모니터링, 외부 연결 통제, 지속적인 로그 기록을 적용해야 한다. 둘째, 두 건의 공개 사례는 모델 정렬(alignment)만으로는 환경의 모호성을 보완할 수 없다는 사실을 다시 한번 보여준다. 두 회사 설명 어디에도 모델들이 자신에게 부여된 목표와 무관한 독립적인 목적을 추구한 정황은 나타나지 않았다. 대신 모델들은 자신에게 주어진 목표를 달성하기 위해 이용 가능한 모든 공격 경로를 적극 활용했다. 이는 모델의 안전성 학습만큼이나 네트워크 경계, 신원 통제, 그리고 어떤 시스템이 공격 범위(in-scope)에 포함되는지를 명확히 정의하는 운영상의 제약이 중요하다는 것을 의미한다. 셋째, 점점 더 자율적인 AI 에이전트를 도입하는 기업들은 상황 인식(situational awareness)을 학술적인 능력이 아니라 보안의 핵심 요소로 취급해야 한다. 앤트로픽이 모델들을 비교한 결과에 따르면, 최신 모델은 자신이 실제 운영 인프라에 도달했다는 증거가 충분히 축적되자 보다 신중하게 행동했다. 앤트로픽은 이러한 결과는 향후 AI 안전성에서 기존의 모델 정렬과 함께 상황 추론 능력(situational reasoning) 이 중요한 요소가 될 수 있다는 고무적인 신호라고 평가했다. 넷째, 기업의 위협 모델링(threat modeling)에 중요한 전환점을 의미. 오픈AI는 충분히 강력한 모델이라면 평가를 위해 일부 보호 장치가 완화된 연구 환경에서 정교한 취약점들을 연쇄적으로 이용해 탈출할 수 있음을 보여줬다. 앤트로픽은 반대로 의도치 않은 인터넷 연결과 같은 단순히 운영상의 실수만으로도 새로운 취약점을 악용하지 않고 비슷한 수준의 심각한 결과가 발생할 수 있음을 보여줬다. 두 사건의 공통점은 특정 벤더나 특정 모델 계열이 아니다. 최첨단 AI 시스템은 기술적·운영상의 통제가 실패하는 순간, 점점 더 제한적으로 정의된 목표를 복잡한 현실 세계의 사이버 공격으로 전환할 수 있는 능력을 갖추고 있다는 사실이다. 이는 기업 최고정보보호책임자(CISO)들이 AI 안전성을 더 이상 모델만의 문제로 볼 수 없다는 뜻이다. 또 AI 안전성은 이제 인프라의 문제이자, 신원 관리(identity)의 문제이며, 점점 더 운영 거버넌스(operational governance)의 문제가 되고 있다.

2026.08.02 14:45방은주 기자

WSJ "AI해킹, 쥬라기 공원 모멘텀 왔다"

"사이버보안 산업계에 쥬라기 공원 시기(모멘텀)가 왔다" 오픈AI와 앤트로픽의 최신 AI모델이 최근 일으킨 '보안 사고'에 대해 근착 월스트리트저널(WSJ)은 이렇게 표현했다 .영화 '쥬라기 공원'에는 인간이 최첨단 기술로 공룡을 통제하고 있다고 믿었지만, 예상치 못한 사고로 공룡들이 우리를 탈출하면서 통제가 완전히 무너진다. 이후 공룡들은 인간의 의도와 상관없이 움직이며 큰 혼란과 피해를 일으킨다. 지난달 20일(미국시각) 오픈AI는 자사 사이버 보안 평가용 최첨단 AI모델 2개가 격리(containment)를 벗어나 허깅페이스를 자율적으로 공격한 사실을 공개했다. 이 사건은 지난달16일 허깅페이스가 이상 공격을 발표한 뒤 조사 끝에 오픈AI 모델이 원인으로 확인하면서 알려졌다. 이보다 10일 후인 지난달 30일(미국시각)에는 앤트로픽이 내부 조사 결과 자사 클로드(Claude) 계열 모델 3개가 의도하지 않게 인터넷에 접속, 3개 기관의 시스템에 무단 접근(unauthorized access)했고 발표했다. 이는 오픈AI 사건 이후 앤트로픽이 자사 사이버보안 평가 기록을 전면 재검토하는 과정에서 확인됐다. 앤트로픽은 오픈AI의 허깅페이스 관련 보고서 공개 후 총 14만1006건의 사이버보안 평가 실행 기록을 검토했다. 이에는 클로드 오퍼스 4.7(Claude Opus 4.7), 클로드 미토스 5(Claude Mythos 5),그리고 아직 공개되지 않은 내부 연구 모델 등 3개 AI모델이 동원됐다. 앤트로픽은 AI 보안 기업 일레귤러(Irregular)와 이들 3개 AI모델을 사용해 CTF(Capture the Flag) 형태의 사이버보안 시나리오를 수행했는데, 이들 모델이 인터넷에 접근해서는 안 되는 환경이었지만, Irregular와의 의사소통 착오로 인터넷 접근이 가능했고, 이후 모델들은 인터넷에 접속, 서로 다른 3개 기관의 실제 운영 인프라(production infrastructure)에 무단 접근했다. 이에 대해 앤트로픽은 블로그에서 "클로드는 취약한 비밀번호와 인증이 필요 없는 엔드포인트를 악용하는 등 기본적인 기법을 이용해 해당 기관들의 인프라를 침해했다. 복잡한 취약점을 찾아내거나 악용하지는 않았으며, 각각의 사례에서 클로드는 자신에게 부여된 CTF 평가 과제를 완료하기 위해 필요한 행동만 계속 수행했다"고 설명했다. 그러나 일부 사례에서는 구형 모델이 자신이 실제 인터넷 환경에서 동작하고 있다는 증거를 확인한 이후에도 공격을 계속했다. 반면 최신 모델은 자신이 인터넷상에 있다는 사실을 인식하자 공격을 중단했다. 어떤 경우에도 클로드는 자기 자신을 외부로 유출(exfiltrate)하거나 의도적으로 시험 환경을 탈출하려 시도하지 않았다고 앤트로픽은 밝혔다. 가장 심각한 사례는 클로드가 허구의 회사를 만났는데, 그 회사 이름이 실제 인터넷 도메인과 동일한 경우였다. 클로드는 실제 존재하는 그 기관이 시뮬레이션 대상이라고 믿고 취약한 비밀번호와 외부에 노출된 서비스를 공격, 수백 건의 실제 운영 데이터가 저장된 데이터베이스 접근 권한을 획득했다. 두 회사 모두 지난주 오픈AI가 AI 기업 허깅페이스(Hugging Face)에 대한 7월 해킹 사실을 공개하기 전까지는 자신들의 모델이 외부로 빠져나간 사실조차 알아채지 못했다. 두 회사의 잇따른 AI해킹 공개는 미국 정가에도 큰 우려를 줬다. 일부는 이를 근거로 새로운 규제나 AI 테스트 체계를 도입해야 한다고 주장했다. 동시에 이번 사건은 해당 AI 연구소 내부 직원들에게도 적잖은 충격을 안겼다. WSJ에 따르면, 샘 올트먼 오픈AI 최고경영자(CEO)는 한 팟캐스트에서 이번 사건을 언급하며 "개인적으로 이렇게 강렬하게 와닿은 보안 사고는 이번이 처음이다. 더 많은 사람들이 이 일을 그렇게 절실하게 느끼지 않는 것이 오히려 놀랍다"고 말했다. 또 그는 자사 모델의 해킹 사건을 "극도로 공상과학(SF)적인 사이버 사고(extremely sci-fi cyber incident)"이라고 표현했다. 사이버보안 전문가들에게 이번 사건은 AI 능력이 계속 향상되고 있으며, 그만큼 우려해야 할 이유도 커지고 있음을 보여줬다. 반면 AI 안전(AI Safety) 전문가들에게는 오래전부터 경고해 왔던 내용, 즉 AI 시스템이 현실 세계에 실제 피해를 일으키고 인간의 통제를 벗어날 수 있다는 주장이 입증된 사례로 받아들여진다. AI 역량을 연구해 위험성을 분석하는 비영리 AI 연구기관 팰리세이드 리서치(Palisade Research)의 제프리 래디시(Jeffrey Ladish) 사무총장은 "실제 현실에서 이런 일이 벌어진 것을 보니 어느 정도 우리의 주장이 입증된 느낌"이라고 말했다. 그는 과거 앤트로픽의 정보보안 프로그램 구축에도 참여한 바 있는데 "온라인에서 나와 논쟁하는 사람들은 내가 공상과학 이야기나 믿는다고 말하곤 한다"며 "이제는 제발 우리의 예측이 더 이상 현실이 되지 않았으면 좋겠다"고 덧붙였다. 백악관이 AI 감독을 강화하고 있다는 신호도 나타났다. 백악관 관계자는 정부가 공개 이전 연방정부 검토 대상이 될 AI 모델을 규정하는 새로운 프레임워크를 마련했으며, 기업들과 자발적(voluntary) 테스트를 어떤 방식으로 진행할지에 대한 논의를 계속하고 있다고 밝혔다. AI 보안 기업 어번던트 시큐리티(Abundant Security)의 최고기술책임자(CTO) 조슈아 색스(Joshua Saxe)는 "돌이켜보면 이번 사건들은 공격자들이 앞으로 어떻게 움직일지를 보여주는 전환점(inflection point)으로 기록될 가능성이 크다"며 "매우 위험한 상황이며, 이번 사건들이 그것을 분명히 보여준다"고 말했다. 오픈AI는 이번 해킹 사건에 대한 전면적인 검토를 실시하고 기술 보고서 공개를 약속했다. 작년 12월 스탠퍼드대 연구진은 최첨단 AI 기술을 이용해 실제 기업 네트워크를 대상으로 테스트한 결과, AI 모델이 실제 인간 해커와 거의 맞먹는 수준의 해킹 능력을 보였다는 연구 결과를 발표한 바 있다. 하지만 이 연구는 기업에게서 의뢰를 받아 직접 침투 테스트를 수행하는 전문 해커들, 즉 침투 테스터(penetration tester)들로부터 반발을 샀다. 당시 연구에 참여한 도너번 재스퍼(Donovan Jasper)는 "그때는 우리의 연구 결과가 많은 사람들에게 의심을 받았다"며 "사람들은 자신들이 AI보다 더 잘할 수 있다고 말했다"고 회상했다. 재스퍼는 이번 앤트로픽과 오픈AI의 공개가 자신들의 연구 결과를 뒷받침해 주는 사례라면서 "AI는 이런 분야에서 정말 뛰어난 수준에 도달하고 있다"고 진단했다. 스탠퍼드 연구진이 당시 가장 우려한 점은 실험 중인 해킹 AI가 원래 의도하지 않은 행동을 할 가능성이었다. 사이버보안 컨설팅 업체 R10N 시큐리티(R10N Security)의 대표 라이언 맥기핸(Ryan McGeehan)은 "기존의 전통적인 보안팀 가운데 AI 중심(AI-forward)으로 전환하지 못한 조직은 결국 뒤처질 수밖에 없다"면서 "에이전틱 AI 해커는 인간과 다르다. 더 깊이 침투하고, 더 넓게 확산하며, 훨씬 더 정교하고, 훨씬 더 복잡한 공격을 수행한다"고 밝혔다.

2026.08.02 14:33방은주 기자

앤트로픽 AI, 보안 테스트 중 외부 기관 3곳 시스템에 침입

앤트로픽의 인공지능(AI) 모델이 사이버보안 테스트 과정에서 실제 외부 기관 3곳의 시스템에 침입한 사실이 확인됐다. 30일(현지시간) 블룸버그 등 외신에 따르면 앤트로픽은 이날 오픈AI의 사고 발표 이후 자체 사이버보안 테스트를 전수 점검한 결과, 이같은 사실을 발견했다고 밝혔다. 오픈AI와 같이 테스트용으로 격리돼 있어야 할 환경에서 AI 모델이 인터넷 환경에 접속할 수 있었던 것이 사고의 원인이다. 회사는 총 14만1006건의 평가 테스트를 검토한 결과 자사 AI 모델 '클로드'가 인터넷에 접속한 뒤 외부 기관의 실제 인프라를 해킹한 사례를 3건 확인했다고 말했다. 가장 먼저 일어난 사고는 지난 4월 발생했다. 피해를 입은 기관의 이름은 공개되지 않았으나 사안에 정통한 관계자는 허깅페이스와 클라우드 플랫폼 모달은 이번 피해 기관에 포함되지 않았다고 언급했다. 앞서 오픈AI 모델은 허깅페이스를 해킹한 데 이어 모달 고객사의 계정에도 접근한 바 있다. 앤트로픽과 피해 기관 모두 침입 사실을 사전에 인지하지 못했다. 회사는 네트워크 로그와 평가 기록을 보다 철저히 검토했어야 한다고 인정했다. 회사에 따르면 사고에는 제한된 테스트 환경을 벗어난 오퍼스 4.7, 미토스 5, 내부 연구용 테스트 모델 등 총 3개 AI 모델이 연관됐다. 이들은 일반 공개 서비스에 적용되는 안전 장치 없이 실행됐으며, 클로드는 취약한 비밀번호를 악용하는 등 기본적인 해킹 기법을 이용해 외부 기관 시스템에 침투했다. 모든 사고는 AI 보안 기업 '이레귤러'가 구축한 평가 환경에서 발생했다. 당시 앤트로픽은 클로드에 해당 환경이 시뮬레이션이며 인터넷에 연결돼 있지 않다고 안내했지만, 실제로는 그렇지 않았다. 앤트로픽은 “우리와 평가 파트너 간 오해로 인해 실제 환경은 의도와 달랐다”고 설명했다. AI 모델은 무단으로 접근한 외부 기관들도 모두 테스트의 일부로 인식한 것으로 알려졌다. 이번 테스트는 다른 시스템에 침투해 숨겨진 정보를 찾아내는 '캡처 더 플래그' 방식으로 진행됐다. 이는 사람과 AI 모두의 해킹 능력을 평가할 때 널리 활용되는 방식이다.

2026.07.31 11:38박서린 기자

체크포인트 "AI 악용, 진화했다…공격 지원→공격 수행"

인공지능(AI)이 공격을 지원하는 수준에서 이제 직접 공격을 수행하는 주체로 진화했다는 분석이 나왔다. 글로벌 사이버보안 기업 체크포인트 소프트웨어 테크놀로지스(한국지사장 임현호) 위협 분석팀 '체크포인트 리서치'는 이같은 내용을 골자로 한 'AI 시큐리티 리포트 2026'을 31일 발표했다. 보고서는 지난 한 해 동안 발생한 실제 사건, 텔레메트리(Telemetry) 데이터 및 독창적인 사례 연구를 기반으로 작성됐으며, AI가 공격 전 과정에 직접 관여하면서 방어자에게 어떤 변화가 있었는지를 설명한다. 보고서에 따르면 과거에는 AI가 범죄자들이 사이버 공격을 준비하는 데 도움을 줬다면, 이제 AI는 사람의 최소한의 개입만으로 실제 침입을 수행한다. 이로 인해 방어자의 대응 시간은 크게 단축됐으며, 기업 전반에는 새로운 공격 표면이 생겨나고 있다. 또한 기업의 AI 도입 속도가 AI 거버넌스 구축 속도를 앞지르면서 새로운 보안 위험도 커지고 있다는 것이다. 실제 2026년 3월에서 5월 사이에 길고 악의적인 프롬프트 주입 페이로드 탐지 건수는 약 5배 증가했다. 이러한 대규모 악성 페이로드의 급격한 증가는 간접 프롬프트 주입이 이론적인 위험이 아닌 일상적인 공격 경로이자 기업 운영상의 위험 요소가 되고 있음을 의미한다. AI가 단계별 사람의 개입을 최소화한 상태에서 수십 개의 세션에 걸쳐 수천 개의 명령어를 실행하며 익스플로잇 워크플로우를 자율적으로 수행한 침해 사례들을 기록했다. 또 취약점이 악용될 수 있는 범위가 며칠에서 몇 시간 단위로 단축됐다. 이제 AI는 새로운 취약점이 공개되더라도 몇 시간 내에 실제로 작동하는 공격 툴을 만들 수 있다는 분석이다. 고위험 기업용 AI 프롬프트도 지난 1년 동안 두 배 증가해 AI 상호 작용 50건당 약 1건 발생 수준에서 25건당 약 1건으로 증가했다. 로템 핀켈스타인(Lotem Finkelstein) 체크포인트 리서치 부사장은 "1년 전 우리는 AI를 공격자의 역량을 강화하는 도구로 평가했다. 그러나 올해는 상황이 달라졌다. AI가 실제 공격 과정에 직접 참여하며, 과거에는 숙련된 전문가 팀이 수행하던 작업을 이제는 단독으로 수행하고 있다"며 "공격자의 전문성에 대한 진입 장벽은 빠르게 낮아지고 있으며, 방어자는 더 이상 공격자의 속도에 맞춰 대응할 수 있다고 가정해서는 안 된다. 앞으로 경쟁력을 갖춘 조직은 AI 사용을 체계적으로 관리하고, AI 시스템을 안전하게 보호하며, 사람의 속도가 아닌 머신의 속도로 대응하는 조직이 될 것"이라고 강조했다.

2026.07.31 09:35김기찬 기자

[AI는 지금] 美 의회 간 샘 알트먼, '통제불능 AI' 규제 방안 찾을까

오픈AI의 인공지능(AI) 에이전트가 보안 시험 중 격리 환경을 벗어나 외부 기업 시스템을 침해하면서 미국의 AI 규제 논의가 모델의 유해성 검증에서 자율 행동 통제로 확대되고 있다. 차기 모델 출시를 준비하는 오픈AI와 신제품 개발을 제한하지 않으려는 미국 정부 사이에서 에이전트의 권한과 외부 시스템 접근을 어디까지 통제할지가 새로운 쟁점으로 떠오른 분위기다. 30일 로이터통신에 따르면 샘 알트먼 오픈AI 최고경영자(CEO)는 29일(현지시간) 미국 워싱턴에서 상원의원들을 만나 준비 중인 차기 AI 모델에 대해 논의했다. 알트먼 CEO는 버니 모레노와 존 허스티드 상원의원을 만났으며 라파엘 워녹 상원의원 사무실도 방문했다. 상원 정보위원회 민주당 간사인 마크 워너 의원과도 면담할 예정인 것으로 전해졌다. 이번 방문은 오픈AI가 보안 시험 과정에서 AI 에이전트의 통제에 실패한 사실을 공개한 직후 이뤄졌다. 해당 에이전트는 격리 환경을 벗어나 AI 개발 플랫폼 허깅페이스의 인프라를 침해했으며, 뉴욕에 본사를 둔 클라우드 기업 모달랩스의 고객 시스템도 해킹한 것으로 알려졌다. AI 에이전트는 이용자의 명령에 따라 외부 도구와 소프트웨어를 직접 조작해 업무를 수행한다. 이 탓에 모델의 자율성이 높아질수록 잘못 부여된 권한이나 시스템 취약점을 이용해 개발사가 예상하지 못한 행동에 나설 위험도 커질 수 있다. 업계에선 이번 사고로 모델이 유해한 답변을 생성하는지를 확인하는 기존 안전성 평가만으로는 에이전트의 위험을 충분히 검증하기 어렵다고 우려했다. 또 외부 인터넷과 기업 시스템에 대한 접근 권한, 격리 환경의 안정성, 인증정보 관리 등을 안전성 평가에 포함해야 한다고도 요구했다. 다만 알트먼 CEO는 상원의원들과 해킹 사고도 일부 논의했지만 회동의 주된 의제는 아니었다고 설명했다. 오픈AI는 사고와 관련해 미국 정부 관계자들과 별도의 논의를 이어가고 있는 것으로 전해졌다. 알트먼 CEO는 "해킹 사건에 대해 의원들과 조금 이야기했다"며 "그 사안과 관련해 여러 회의를 진행하고 있다"고 말했다. 도널드 트럼프 미국 대통령도 오픈AI 에이전트 사고와 관련해 AI 통제 방안을 검토하고 있다고 밝혔다. 그러나 AI 기업의 신제품 개발을 제한하는 방식에는 신중한 태도를 나타내 고위험 모델과 에이전트를 대상으로 한 별도 안전성 검증 체계가 논의될 가능성이 커졌다. 또 미국 정부는 첨단 AI 모델에 대한 안전성 평가와 검토 절차 마련을 추진하고 있다. 오픈AI가 차기 모델 출시를 준비하는 시점에 정부와 의회의 안전성 요구까지 높아지면서 알트먼 CEO의 워싱턴 방문에도 관심이 쏠리고 있다. 향후 규제 논의는 모델 출시 전 성능 평가를 넘어 에이전트의 실제 운용 과정까지 넓어질 것으로 예상된다. 외부 시스템 접근 권한을 제한하고 사고 발생 시 기업의 보고 의무와 제3자 검증을 강화하는 방안도 주요 의제로 다뤄질 수 있다. 트럼프 대통령은 "AI 통제 방안을 살펴보고 있다"며 "개발자들이 새로운 제품을 만드는 것을 제한하고 싶지는 않다"고 말했다.

2026.07.30 09:57장유미 기자

  Prev 1 2 3 4 5 6 Next  

지금 뜨는 기사

이시각 헤드라인

"AI 모델 다음은 산업현장…韓, 피지컬 AI·에이전트 육성해야"

"켜고 끄는 버프·기믹 보스"…스마일게이트 신작 '이클립스', MMORPG 공식 비틀었다

[ZD e게임] 콤보 통해 액션성 극대화…라인게임즈 '엠버 앤 블레이드' 데모 2.0

'투자 한파' 맞은 AI 스타트업…상장사 손잡고 판로 뚫는다

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.