• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'다투모'통합검색 결과 입니다. (7건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

셀렉트스타, 금융권 AI 신뢰성 검증 역할 강화

셀렉트스타가 금융업계 인공지능(AI) 안전성 교육과 범용·금융 특화 취약점 확인 역량을 앞세워 금융권 AI 신뢰성 검증 분야 입지를 넓힌다. 셀렉트스타는 금융보안원이 주최하고 카카오뱅크가 후원하는 '2026 금융보안 AI 아카데미 캠프'에서 AI 신뢰성 검증 '다투모 플랫폼' 제공 등 행사 운영을 담당했다고 23일 밝혔다. 금융보안 AI 아카데미 캠프는 AI 정보보안에 관심 있는 대학(원)생을 대상으로 금융권 AI·보안 분야의 실무 역량을 높이기 위해 마련된 단기 집중 교육 프로그램이다. 지난 20일부터 22일까지 경기도 용인 카카오 AI 캠퍼스에서 열린 올해 행사에는 50명이 참가했다. 첫날은 김민우 셀렉트스타 AI 세이프티 팀 리더가 강연자로 나서 AI 안전성과 보안에 관한 이론 및 실습 교육을 진행했다. 교육은 OWASP 거대언어모델(LLM) 톱 10을 비롯해 AI 레드티밍 기법, 자동 AI 레드티밍, AI 가드레일, 금융 특화 AI 세이프티 평가 등 최신 AI 보안 기술과 연구 동향을 중심으로 구성됐다. 이튿날 진행된 레드팀 챌린지는 범용 안전성과 금융 특화 안전성 영역으로 구분해 1부 개인전, 2부 팀전으로 운영됐다. 참가자들은 각 미션에 따라 다양한 공격 기법을 설계·적용하면서 AI 모델의 취약점을 발굴하고 금융 서비스 환경에서 발생할 수 있는 위험 요소를 분석했다. 셀렉트스타는 레드티밍 결과를 신속하고 일관된 기준으로 판별할 수 있도록 챌린지 운영에 AI 자동 평가 시스템을 도입했다. 다수의 참가자가 제출하는 공격 결과를 자동으로 분석·채점해 평가 속도와 정확성을 높였다. 2부 팀전에서는 국내 최초로 '인간 대 AI' 방식의 레드티밍 대결이 진행됐다. 참가자들은 5명씩 조를 이뤄 AI 에이전트와 동일한 미션을 수행했는데, 멀티 AI 에이전트 레드티머가 인간을 근소한 차이로 앞섰다. 김 리더는 "생성형 AI가 금융 서비스에 빠르게 적용되면서 범용적인 안전성뿐만 아니라 금융 도메인의 특성과 규제를 반영한 정교한 검증 역량이 중요해지고 있다"며 "이번 캠프가 금융 서비스의 특성과 규제를 반영한 AI 안전성 평가를 직접 경험하고, 잠재적 위험에 어떻게 대응해야 할지 고민하는 계기가 됐길 바란다"고 말했다.

2026.07.23 15:41이나연 기자

[AI 리더스] 셀렉트스타는 어떻게 은행 '신뢰성 검증' 도맡았나

"사람이 100% 수작업으로 했다면 60일이 걸렸을 평가를 50분 만에 끝냈습니다." 김세엽 셀렉트스타 대표는 지난 13일 서울 강남구 본사에서 지디넷코리아와 만나 NH농협은행 생성형 인공지능(AI) 서비스 검증 사례를 이같이 소개했다. NH농협은행은 사내 업무·금융 지식 질의응답 AI를 개발하면서 셀렉트스타의 신뢰성 검증 자동화 솔루션 '다투모 이밸(DATUMO eval)'을 도입했다. 평가 기간이 두 달에서 한 시간 이내로 줄면서 AI를 수정할 때마다 검증을 다시 돌려 목표 성능에 도달했는지 확인할 수 있게 됐다. 다투모 이밸을 정식 도입한 은행은 NH농협은행만이 아니다. 우리은행은 국내 최초 AI 청약 상담 서비스를 개발하며 금융보안원 보안성 검증을 이 솔루션으로 진행했고, 신한은행은 현업 부서가 직접 AI 서비스를 만드는 전사 생성형 AI 플랫폼에 평가 모듈로 탑재했다. 세 은행 모두 별도 기술검증(PoC) 기간 없이 곧바로 정식 도입을 택했다. 김 대표는 "세 은행 모두 생성형 AI를 도입하는 과정에 평가가 필수라는 인식이 명확했다"며 "다투모 이밸이 정확하고 일관되게 목표 수준 도달 여부를 확인해 준다는 점이 바로 도입으로 이어졌다"고 설명했다. 은행들이 AI 서비스 평가를 속속 도입하게 된 배경에는 바로 규제 완화가 있다. 금융당국이 망분리 규제를 풀고 혁신금융서비스 제도로 외부 AI 활용 길을 열자 은행의 AI 도입은 그룹 차원으로 확산됐다. 하지만 서비스 신뢰도를 확인하는 검증 절차는 사람이 일일이 평가 질문을 만들고 답변을 검수하는 수작업에 머물러 있었다. 김 대표는 "사람이 직접 평가하던 방식으로는 충분한 AI 검증이 이뤄질 수 없었다"며 "고객 신뢰와 리스크 관리가 핵심인 금융에서 안전성 판단이 서지 않으면 어떤 액션도 할 수 없다"고 강조했다. 은행들이 AI 서비스 도입에 있어 가장 경계하는 위험은 환각(할루시네이션)이다. 상품 설명서와 약관 등 정해진 문서를 근거로 답해야 하는 업무 특성상 AI가 없는 내용을 지어내면 곧바로 금융 사고로 이어지기 때문이다. 민감 정보 유출을 막는 보안 평가, 편향·부적절 발언을 거르는 안전성 평가도 주요 검증 항목으로 꼽힌다. 여기에 AI가 실제 업무를 수행하는 에이전트로 진화하면서 정답이 정해지지 않은 업무까지 원칙 기준으로 채점해야 하는 단계에 이르렀다. 셀렉트스타는 라우터·플래너·툴콜링 등 에이전트 핵심 구성 요소 하나하나를 평가하도록 솔루션을 확장했다. 문제는 평가를 반복할수록 커지는 비용 부담이다. AI 답변을 채점할 때마다 거대언어모델(LLM)을 가져와 쓰면 그만큼 컴퓨팅 비용이 불어난다. 이를 보완하기 위해 등장한 평가 특화 모델들은 언어나 도메인이 바뀌면 채점 성능이 급격히 떨어지는 한계가 있었다. 셀렉트스타가 채점 성능은 유지하면서 크기를 줄인 평가 특화 소형 모델 '이스타(E-Star) 12B'를 직접 개발한 이유다. 이 모델은 언어가 영어에서 한국어로, 분야가 일반에서 금융·법률로 바뀌어도 일관된 평가 성능을 낸다. 관련 논문은 최근 자연어처리 분야 국제 학회 ACL 2026 워크숍에 채택되기도 했다. 김 대표는 "E-Star 12B는 오픈AI 'GPT-5.5' 96% 수준으로 평가하면서도 크기가 작아 반복 평가에 드는 컴퓨팅 부담을 줄였다"며 "보안 규정상 외부 AI로 데이터를 보낼 수 없는 금융사 내부망에서 구동되는 점도 강점"이라고 부연했다. 기술 못지않은 차별점은 운영 방식에 있다. 셀렉트스타는 평가 지표 131종을 기본 제공하면서 사내 신뢰성 평가 전문가가 고객 도메인 전문가와 함께 지표를 새로 설계하는 컨설팅을 병행한다. 이 전담 인력만 전체 임직원 170명(5월 말 기준) 가운데 18명이다. 팔란티어의 전방 배치 엔지니어(FDE)처럼 고객 문제를 직접 풀며 얻은 경험을 제품에 쌓아 경쟁사들과의 격차를 벌리겠다는 전략이다. 김 대표는 "이 사이클을 얼마나 돌렸느냐가 결국 진입장벽"이라며 "해외에도 평가 플랫폼은 있지만 컨설팅까지 함께 제공하는 곳은 많지 않다"고 강조했다. 금융에서 쌓은 경험은 다른 산업으로 확장되고 있다. 공공·국방 분야에서는 일부 사업 수주가 확정돼 계약 절차를 밟는 중이다. 제조 분야에서는 AI 판단 오류가 물리적 사고로 이어질 수 있는 피지컬 AI를 겨냥해 사내 연구소가 평가 기술 연구개발에 들어갔다. 해외 시장은 미국과 일본, 중동 세 축으로 공략한다. 이미 지사를 둔 미국에서는 전략적 투자자인 세일즈포스와 협업 접점을 넓히고 있다. 일본의 경우 K-스타트업센터(KSC) 도쿄 입주 프로그램에 선정돼 지사 설립을 위한 거점부터 확보했다. 중동은 데이터센터부터 모델까지 국가 차원의 소버린(주권) AI를 추진하는 만큼 관련한 초기 협력 논의를 진행하고 있다. 김 대표는 "신뢰성 평가는 한 번 하고 끝나는 일이 아니라 AI를 운영하는 내내 반복적으로 돌아가는 구조"라며 "고객이 AI 서비스를 지속적으로 개선하도록 돕는 엔드투엔드 플랫폼을 만드는 것이 목표"라고 밝혔다.

2026.07.19 08:06이나연 기자

단순 점수보다 기업 맞춤형···셀렉트스타, AI 신뢰성 해법 전한다

셀렉트스타가 거대언어모델(LLM) 기반 서비스의 실제 성능과 신뢰성을 정교하게 측정하려는 기업들을 위해 실무적인 검증 기준을 제시한다. 셀렉트스타는 다음 달 5일 오후 2시 '커스텀 평가 체계로 LLM 서비스 평가 기준 만들기'를 주제로 무료 웨비나를 개최한다고 27일 밝혔다. 이번 행사는 벤치마크 점수와 실제 서비스 위험 간의 괴리를 좁히고, 기업이 AI 서비스를 안심하고 출시할 수 있도록 돕는 의사결정 프레임워크를 공유하는 자리다. 웨비나에선 ▲LLM 판사 기반 평가 ▲정량·정성·혼합 평가 방법론 등 최신 트렌드를 소개하고 수작업 중심 평가를 자동화해 리소스를 효율화하는 전략을 다룬다. 특히 기업 내부 거버넌스 체계에 맞춘 서비스 출시 기준 설정법과 실제 기업들 운영 사례를 공개할 예정이다. 셀렉트스타는 국내 최초 AI 신뢰성 평가 자동화 플랫폼인 '다투모 플랫폼'을 활용해 평가 프로세스를 체계화한 사례도 소개한다. 이찬수 셀렉트스타 사업개발팀장은 "많은 기업이 LLM을 도입하면서도 정작 서비스 목적에 맞는 명확한 평가 기준을 세우는 데 어려움을 겪는다"며 "이번 웨비나를 통해 데이터 기반으로 AI 서비스 출시 여부를 판단할 수 있는 지표를 마련하길 기대한다"고 말했다.

2026.02.27 14:45이나연 기자

셀렉트스타, 구글·MS와 'AI 신뢰성' 표준 논의…글로벌 리더십 '증명'

셀렉트스타가 자체 기술력을 앞세워 글로벌 인공지능(AI) 신뢰성 표준을 정립한다. 셀렉트스타는 지난 15일 서울에서 열린 '글로벌 프라이버시 총회(GPA 2025)', 17일부터 이틀간 일본 오사카에서 개최된 '글로벌 스타트업 엑스포 2025(GSE 2025)'에 연이어 참가했다고 19일 밝혔다. 이 자리에서 회사는 자체 개발한 AI 신뢰성 검증 솔루션 '다투모 이밸'을 국제 무대에 소개했다. 특히 서울 그랜드 하얏트 호텔에서 진행된 GPA 사전 행사 '오픈소스 데이'에서는 국내 스타트업 중 유일하게 발표 세션을 맡았다. 구글, 마이크로소프트, 메타, 오픈AI 등 글로벌 빅테크 기업과 어깨를 나란히 해 주목받았다. 발표자로 나선 황민영 셀렉트스타 부대표는 생성형 AI 신뢰성 검증 솔루션 '다투모 이밸'을 소개했다. 그는 한국어 벤치마크 데이터셋 구축 사례를 공유하며 기업의 챗봇 개발 시 ▲환각 현상 방지 ▲시스템 안전 기준 충족 ▲적절한 데이터 기반 답변 보장이 핵심이라고 강조했다. 이어진 일본 오사카 'GSE 2025'에서는 단독 부스를 운영하며 일본 및 해외 기업과 협력 가능성을 모색했다. 황 부대표는 유망 스타트업 피치 세션인 '딥 테크 스타트업 피치 이벤트' 무대에 올라 글로벌 투자자와 업계 리더들에게 셀렉트스타의 비전을 발표했다. 셀렉트스타의 국내 입지도 강화되고 있다. 김세엽 대표는 지난 8일 출범한 국가인공지능전략위원회 데이터 분과위원으로 위촉돼 대한민국 AI 액션플랜 수립에 참여한다. 더불어 회사는 '독자 AI 파운데이션 모델' 사업 정예팀에도 합류해 모델 개발에 힘을 보태고 있다. 황민영 셀렉트스타 부대표는 "AI 신뢰성과 개인정보보호는 글로벌 딥테크 기업들 사이에서 초미의 관심사로 떠오르고 있다"며 "이번 GPA와 GSE 참여를 통해 국제 파트너들과 긴밀히 협력하고 글로벌 AI 생태계에서 신뢰성 표준을 만들어가겠다"고 밝혔다.

2025.09.19 17:42조이환 기자

세계 1위 CRM 세일즈포스도 찍었다…美서 다투모로 알려진 이 회사, 205억원 투자 유치

생성형 인공지능(AI) 활용의 신뢰 및 안전에 대한 전 세계적인 관심이 높아지고 있는 가운데 셀렉트스타가 대규모 투자 유치를 통해 경쟁력을 입증했다. 세계 1위 고객 관계 관리(CRM) 기업 세일즈포스까지 셀렉트스타의 AI 데이터 및 신뢰성 검증 능력을 인정해 투자에 나서면서 글로벌 시장 확대에도 더 속도를 낼 수 있게 됐다. 12일 테크크런치 등 주요 외신에 따르면 셀렉트스타는 지난 11일 세일즈포스 벤처스와 ACVC파트너스 등 해외 투자 파트너들과 KB인베스트먼트, KB증권, 신한벤처투자, 키움인베스트먼트, SBI인베스트먼트, 삼성증권, 무림캐피탈, 인포뱅크파트너스 등 국내 투자사를 통해 1천550만 달러(약 205억원) 규모의 시리즈B 투자 유치에 성공했다. 이에 따라 누적 투자유치액은 총 2천800만 달러(약 379억원)을 달성했다. 셀렉트스타는 해외에선 다투모(Datumo)라는 기업명으로 알려져 있다. 셀렉트스타라는 법인명을 해외 다른 기업이 사용하고 있어 미국 법인명을 제품명과 동일한 '다투모'로 정해 지난 3월부터 활동 중이다. 서울에선 지난 2018년 설립돼 AI 개발에 필수적인 데이터 수집·가공 솔루션을 제공하며 국내 5대 그룹 및 5대 금융그룹을 포함한 320여 고객사를 확보했다. 김세엽 셀렉트스타 대표는 국방과학연구소 AI 연구원 출신으로, 카이스트 동문 5명과 함께 공동 창업했다. 2023년부터는 라이선스가 확보된 고품질 학습용 데이터셋 판매 서비스를 론칭해 누적 판매 50억원을 돌파했다. 최근에는 한국어 데이터셋 구매를 희망하는 글로벌 기업의 문의가 이어지는 가운데 다국어 및 멀티모달 데이터셋 분야로 확장 중이다. 지난해에는 약 600만 달러의 매출을 기록했다. 이들에 투자에 참여한 기관들은 셀렉트스타의 기술력과 글로벌 성장 가능성에 주목했다. 특히 세일즈포스는 AI 데이터 분야에서 셀렉트스타가 보유한 독보적 기술력과 시장 선도 가능성을 높이 평가하며 전략적 투자를 단행했다. 셀렉트스타는 세일즈포스와의 파트너십을 발판으로 미국, 일본 등 해외 시장 진출에 속도를 낼 전망이다. 김 대표는 "국내에서 열린 행사에서 딥러닝AI 창립자 앤드류 응과 화상 대화를 진행한 것을 링크드인에 공유한 것이 세일즈포스 벤처스의 관심을 끌게 됐다"며 "자금 조달 과정은 약 8개월 가량 소요됐다"고 말했다. 셀렉트스타는 올해 초 국내 최초로 생성형 AI 신뢰성 검증 자동화 솔루션 '다투모 이밸(Datumo eval)'을 출시하며 업계의 주목을 받았다. '다투모 이밸'은 신뢰성 검증 프로세스를 자동화해 AI 서비스 운영 중 발생할 수 있는 다양한 오류와 위험성을 사전에 식별, 대응하는 국내 최초 솔루션이다. 출시 이후 신한은행, 우리은행, NH농협은행 등에 도입됐다. 오는 8월에는 시티그룹 AI 총괄과 'AI 신뢰성 검증'을 주제로 한 글로벌 웨비나를 개최하며 글로벌 금융권의 실질적 수요 확대가 기대되고 있다. AI 데이터 및 신뢰성 검증 영역에 꾸준히 기술력을 쌓아온 셀렉트스타는 과학기술정보통신부가 주관하는 '독자 AI 파운데이션 모델 개발 사업'에 SKT 컨소시엄으로 참여, 지난 4일 최종 선발팀으로 이름을 올렸다. 셀렉트스타는 모델 안정성 검증 데이터를 비롯해 데이터 파트 전반을 총괄하며 완성도 높은 국가대표 AI 개발에 일조할 예정이다. 셀렉트스타는 시리즈B 투자 유치를 기점으로 신뢰성 검증 솔루션 기술 고도화 및 글로벌 시장 진출에 본격적으로 나설 예정이다. 이 외에도 포브스코리아 '2025 대한민국 AI 50' 선정, 국내 최초 '생성형 AI 레드팀 챌린지' 대표 파트너사로 행사 운영, MWC 2025 '글로벌 AI 레드팀 챌린지' 주최 등 다양한 국내외 프로젝트를 주도하며 글로벌 수준의 기술력을 인정받았다. 시리즈B 투자를 리드한 KB인베스트먼트 김승환 글로벌투자본부장은 "셀렉트스타는 국내 AI 데이터 분야에서 선두를 달리는 기업이지만, 꾸준한 도전과 성장으로 업계에 새로운 기준을 제시하고 있다"며 "'AI 신뢰성 검증' 초기 시장에서 이미 확실한 기술력을 확보하고 있고, 다양한 산업 도메인에서 AI 상용화가 가속화됨에 따라 의미 있는 성과를 만들어 낼 것으로 기대한다"고 설명했다. 쇼 야마나카 세일즈포스 수석심사역은 "이번 투자는 세일즈포스가 한국 시장을 겨냥한 AI 투자 및 사업 확장의 전략적 이정표가 될 것"이라며 "양사의 파트너십을 기반으로 '에이전트포스(Agentforce)'를 비롯한 글로벌 AI 에이전트 사업 전반에서 강력한 시너지를 창출할 것으로 기대한다"고 강조했다. 업계에선 이번 일을 두고 메타가 최근 데이터 라벨링 기업 스케일AI에 14억3천만 달러를 투입해 인수한 것과 비슷하다고 봤다. 또 셀렉트스타가 스케일AI와 유사하게 사전 훈련 데이터셋을 제공하고, 아리제AI처럼 AI 평가 및 모니터링 분야에서 제품을 선보이고 있다는 점을 높게 평가했다. 테크크런치는 "동종 기업과 달리 셀렉트스타(다투모)는 '다투모 이밸'이라는 풀 스택 평가 플랫폼을 제공하고 있다"며 "출판된 책에서 크롤링한 데이터셋을 통해 차별화한 것도 눈에 띈다"고 말했다. 김 대표는 "이번 시리즈B 투자 유치를 계기로 신뢰성 검증이라는 새로운 시장에서 우리의 독보적인 기술력과 성장 가능성을 인정받았다는 데 큰 의미가 있다"며 "글로벌 시장 진출의 원년으로 삼고 AI의 품질과 안전성을 책임지는 글로벌 AI 기업으로 도약하겠다"고 밝혔다.

2025.08.12 09:46장유미 기자

셀렉트스타, '다투모 이밸'로 금융권 공략…삼성생명과 데이터 품질 '실증'

셀렉트스타가 삼성생명과 함께 금융권에 특화된 인공지능(AI) 신뢰성 검증 프로젝트에 돌입했다. 고신뢰 산업군의 실제 업무 기준에 부합하는 데이터와 모델 평가 체계를 마련하려는 행보다. 셀렉트스타는 삼성금융네트웍스의 오픈 이노베이션 프로그램 '2025 씨랩 아웃사이드(C-Lab Outside)'에 최종 선정돼 삼성생명과 5개월간 협업을 시작했다고 5일 밝혔다. 셀렉트스타는 이 프로젝트를 통해 약 3천만원 규모의 솔루션 개발비를 지원받는다. 이번 협업은 금융 도메인에 적합한 AI 모델의 검증 수요가 증가하는 가운데 이뤄졌다. 셀렉트스타의 데이터 컨설팅 역량을 접목해 내부 업무에 최적화된 거대언어모델(LLM) 검증 절차를 구축하는 데 초점이 맞춰졌다. 셀렉트스타는 삼성생명의 내부 데이터를 분석해 학습에 적합한 데이터 구축 전략을 수립하고 있다. 해당 데이터를 바탕으로 실제 서비스 환경에서 LLM의 응답이 내부 기준에 적합한지를 정량적으로 평가할 예정이다. 이 과정에서 활용되는 솔루션은 셀렉트스타의 자체 AI 신뢰성 검증 툴인 '다투모 이밸'이다. '다투모 이밸'은 업무 조건과 유사한 환경에서 모델 성능을 점검할 수 있어 금융처럼 오류 허용 범위가 좁은 산업군에 적합하다는 평가를 받는다. 삼성생명은 셀렉트스타와의 협업을 통해 데이터 기반의 실질적인 비즈니스 성과로 이어질 수 있는 성능 검증 결과를 도출하겠다는 계획이다. 김세엽 셀렉트스타 대표는 "금융 산업에서 AI 도입의 성패는 데이터 품질과 예측 가능성에 달려 있다"며 "삼성생명과의 협업을 통해 산업 기준에 맞는 AI 평가 프레임워크를 제시하겠다"고 밝혔다.

2025.06.05 13:01조이환 기자

[인터뷰] "AI 탈옥 막아라"…셀렉트스타, MWC25서 '가스라이팅 방지' 모델 테스트

"인공지능(AI)이 산업 전반에 확산됨에 따라 모델의 결함을 찾아내고 위험을 예방하는 '레드티밍'이 보다 중요해지고 있습니다. 우리는 이번에 개최되는 MWC25에 참가해 글로벌 규모의 레드티밍 행사를 열어 AI 모델의 신뢰성을 직접 검증하고자 합니다. 이러한 경험과 데이터를 바탕으로 AI 신뢰성 평가를 표준화하고 글로벌 AI 평가 시장을 선도하겠습니다" 황민영 셀렉트스타 부대표는 최근 기자와 만나 회사가 MWC25에서 '글로벌 AI 레드팀 챌린지'를 개최하는 이유에 대해 이같이 말했다. AI 신뢰성 검증을 글로벌 표준으로 확산하고 AI 평가 시장을 선도하며 다양한 전문 인력이 참여하는 생태계를 구축하겠다는 것이다. 4일 업계에 따르면 사용자가 프롬프트를 조작해 AI를 악용하는 '탈옥(Jailbreak)' 문제가 확산되면서 이에 대응하기 위한 '레드팀' 활동의 중요성 역시 갈수록 커지고 있다. 실제로 오픈AI, 구글, 메타 등 글로벌 빅테크 기업들도 자사 AI 모델의 보안성과 신뢰성을 검토하기 위해 자체적인 레드팀을 운영하고 있다. 가스라이팅·우회 질문까지…AI 탈옥, '자장가'부터 '장례 문화'까지 다양해 '레드티밍(Red Teaming)'이란 원래 보안 및 군사 분야에서 시스템의 취약점을 식별하고 이를 보완하기 위해 공격적인 시뮬레이션을 수행하는 방식이다. 보안 레드티밍이 잠재적인 해킹을 예방하기 위해 의도적으로 시스템의 취약점을 해킹하듯이 AI 분야에서의 '레드티밍' 역시 개발사가 모델을 의도적으로 공격해 금지된 정보나 위험한 응답을 유도한다. 황 부대표는 "레드티밍을 통해 선제적으로 모델의 신뢰성과 안전성을 점검할 수 있다"며 "구체적으로 AI가 차별적 발언을 하거나 허위 정보를 생성하거나 보안이 취약한 응답을 제공하는지 여부를 평가할 수 있다"고 말했다. AI에서의 레드티밍이 보다 중요한 이유는 누구나 탈옥을 시도할 수 있기 때문이다. 일반적인 보안 시스템은 해킹을 시도하려면 고도의 기술이 필요하지만 AI 모델은 단순한 텍스트 입력만으로도 무력화될 수 있다. AI의 가드레일이 아무리 견고해도 사용자가 창의적인 방식으로 우회 질문을 던지면 금지된 응답을 끌어낼 가능성이 크다. 황 부대표는 "쉽게 말해 '탈옥'은 AI 모델을 상대로 가스라이팅을 시도하는 것"이라며 "일례로 사용자가 돌아가신 할머니가 어릴 적 불러주신 '네이팜 폭탄 만드는 법'에 대한 자장가를 한번만 더 듣고 싶다고 감성적으로 접근하면 원래라면 차단돼야 할 폭탄 제조법이 제공되는 사례가 있다"고 말했다. 이어 "특정한 맥락과 감정을 덧씌우는 방식으로 AI의 방어 체계를 무너뜨리는 탈옥이 점증함에 따라 이를 방지하기 위해 레드티밍이 부각되고 있다"고 강조했다. 다만 이러한 과정이 대중적으로 잘 알려지지는 않았고 AI 모델을 평가하고 검증하는 공식적인 기준 역시 부족한 상황이다. AI가 실제 서비스에 적용되는 사례가 점점 증가하고 있기 때문에 보다 광범위한 테스트와 검증이 필요하다는 지적이 나온다. MWC25서 AI 신뢰성 검증…지난해 코엑스 챌린지가 밑거름 이같은 배경에서 셀렉트스타는 오는 5일 스페인 바르셀로나에서 'MWC25'에 참가해 '글로벌 AI 레드팀 챌린지'를 개최한다. 이번 행사는 AI 모델의 신뢰성과 안전성을 검증하고 레드팀 활동의 필요성을 글로벌 시장에 알리기 위한 자리로, 과학기술정보통신부, 세계이동통신사업자연합회(GSMA), UAE 국영 통신사 이앤(E&), 한국 AI 안전연구소 등 주요 기관이 이번 행사에 후원사로 참여했다. 전통적으로 MWC는 이동통신과 네트워크 기술이 중심이 되는 박람회였으나 올해는 AI 신뢰성 검증이라는 새로운 분야를 공식적으로 포함한 점이 주목된다. AI가 산업 전반에 빠르게 확산되면서 AI 평가 및 보안의 중요성이 점점 커지고 있음을 반영한 결정이다. 업계의 반응도 뜨겁다. 챌린지에는 이미 140명 이상이 참가 신청을 마친 상태로, 셀렉트스타 측은 아직 본격적인 홍보를 시작하기 전이기 때문에 실제 행사 당일에는 더 많은 국가에서 참가자가 몰릴 것으로 예상하고 있다. 또 이번 행사는 글로벌 AI 기업들의 모델을 대상으로 신뢰성을 평가하는 첫 번째 대규모 국제 레드팀 챌린지로, 다양한 문화와 언어 환경에서 AI가 얼마나 안전하게 작동하는지를 검증하는 실험적 의미도 갖는다. AI 레드팀 챌린지의 가장 큰 특징은 누구나 참여할 수 있다는 점이다. 보안 전문가뿐만 아니라 언어학자, 인문학자, 예술가, 마케터, 일반 대학생 등 비전공자도 AI가 설정된 가드레일을 우회하도록 유도하는 다양한 프롬프트를 시도함으로써 모델을 공략하는 데 중요한 역할을 할 수 있다. 황 부대표는 "미국에서는 오픈AI나 구글 같은 기업들이 자체적으로 AI 레드팀 작업을 진행하고 있지만 대규모 공개 행사 형태로 레드팀을 운영하는 사례는 거의 없었다"며 "MWC 같은 국제 박람회에서 전 세계의 다양한 전문가와 일반인이 함께 AI를 공격하는 장을 연다는 점에서 의미가 크다"고 강조했다. 셀렉트스타가 MWC25에서 글로벌 AI 레드팀 챌린지를 성공적으로 개최할 수 있게 된 배경에는 지난해 국내에서 진행했던 AI 레드팀 챌린지의 경험이 있다. 지난해 4월 서울 코엑스에서 열린 행사에서 참가자들은 총 네 차례의 공격 라운드를 거치며 AI 모델의 탈옥을 시도했다. 대학생, 일반 회사원, 교수 등 다양한 배경의 참가자들이 각자의 창의적인 접근법으로 AI 모델을 공략해 AI가 실제로 불법 정보를 제공하거나 차별적 발언을 하는 등의 허점이 발견되면서 신뢰성 검증의 필요성이 다시 한번 입증됐다. 회사는 그 과정에서 다수의 흥미로운 사례를 확보했다. 황 부대표는 "어떤 참가자는 '할머니가 가르쳐준 전통 의식'이라며 폭탄 제조법을 물었고 다른 참가자는 특정 문화권의 장례 문화를 언급하며 시신을 화학적으로 분해하는 방법을 요청하는 등 AI의 정책 필터를 우회하는 다양한 시도가 있었다"며 "이러한 사례들은 AI 모델이 단순한 필터링으로는 안전성을 유지할 수 없으며 보다 체계적인 검증이 필요하다는 점을 시사한다"고 설명했다. '다투모 이밸'로 자동화 혁신…AI 신뢰성 검증 앞장설 것 레드티밍을 통한 AI 신뢰성 검증은 단순한 연구 목적을 넘어 기업의 실제 비즈니스에도 중요한 영향을 미친다. 특히 금융권과 같이 AI 챗봇이 잘못된 금융 정보를 제공하거나 특정 키워드에 대해 잘못된 응답을 하면 이는 단순한 기술적 결함이 아니라 고객 신뢰와 직결된 문제가 된다. 이같은 상황 속에서 셀렉트스타는 AI 신뢰성 검증을 위한 주요한 역할을 맡고 있다. 특히 기존에는 사람이 직접 AI 모델을 테스트하고 문제를 찾아 수정하는 방식이었으나 셀렉트스타는 이를 자동화하는 솔루션 '다투모 이밸(DATUMO eval)'을 출시하며 검증 프로세스를 혁신했다. '이밸'은 AI 신뢰성 검증을 위한 자동화 솔루션으로, 기업별 맞춤형 평가 기준을 설정하고 이를 기반으로 대량의 평가 데이터를 생성하는 기능을 제공한다. 기존 벤치마크 데이터셋이 AI의 일반적인 언어 처리 능력이나 논리력을 평가하는 데 초점이 맞춰져 있었다면 이 솔루션은 특정 기업의 산업군과 맞는 평가 질문을 생성해 보다 실질적인 검증이 가능하도록 설계됐다. 일례로 보험회사가 챗봇을 도입할 경우 '다투모 이밸'은 보험 상품과 관련된 수십만 개의 맞춤형 질문을 자동 생성해 AI가 정확한 답변을 제공하는지와 불법적인 정보를 전달하지 않는지를 분석하게끔 돕는다. 이를 통해 기업들은 자사 AI 모델이 경쟁사의 모델보다 신뢰성이 높은지와 특정한 위험한 질문에 대해 어떻게 대응하는지에 대한 실질적인 비교 분석이 가능해진다. 회사는 '다투모 이밸'이 단순한 AI 평가 솔루션이 아니라 AI 신뢰성을 검증하는 새로운 표준이 되도록 글로벌 시장을 적극 공략할 계획이다. 황 부대표는 "전 세계적으로 AI 모델 평가의 중요성이 커지고 있는 가운데 이를 체계적으로 자동화한 기업은 드문 상황"이라며 "우리 솔루션은 글로벌 시장에서도 충분히 경쟁력이 있다"고 강조했다. 이에 따라 MWC25 글로벌 AI 레드팀 챌린지 종료 후 셀렉트스타는 행사를 통해 발견된 핵심 취약사례, 위험 응답 유형, 가장 창의적인 공격 방식 등을 정리한 보고서를 발표할 계획이다. 이 보고서는 AI 안전연구소(AISI), GSMA, 과기정통부 등 후원 기관과 공유되며 글로벌 차원의 AI 신뢰성 검증 논의에도 기여할 전망이다. 또 챌린지에서 확보한 데이터는 '다투모 이밸'의 기능 개선에도 직접 활용된다. 다양한 국가에서 AI 모델을 공격한 데이터를 분석함으로써 AI가 각국의 언어와 문화적 맥락에서 어떻게 반응하는지, 어떤 방식으로 탈옥이 시도되는지를 보다 정교하게 연구할 수 있기 때문이다. 황민영 셀렉트스타 부대표는 "이번 MWC25 글로벌 AI 레드팀 챌린지를 계기로 AI 신뢰성 평가 시장을 본격적으로 공략하고 AI 평가 및 보안 분야의 글로벌 리더로 자리 잡겠다"며 "조만간 AI를 도입하는 기업이라면 누구나 레드팀 테스트를 거쳐야 한다는 인식이 자리잡을 때 우리 솔루션이 핵심적인 역할을 하게 만들 것"이라고 강조했다.

2025.03.04 14:27조이환 기자

  Prev 1 Next  

지금 뜨는 기사

이시각 헤드라인

[ZD브리핑] 3대 메가프로젝트 2차 점검회의...독파모 국민평가단 참여

AI 학과 늘리기만으론 부족…"모든 전공에 AI 역량 심어야"

유니폼부터 AI 로봇 드로잉까지…무료 KT스포츠 팝업 가보니

AI규제는 풀고 OTT는 발목 잡고…'영화 6개월 홀드백' 논란

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.