• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
국감2026
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'GPT'통합검색 결과 입니다. (583건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

딥엘, 챗GPT·코파일럿·클로드 속으로…AI 번역 기능 연동

딥엘이 챗GPT 등 주요 인공지능(AI) 서비스에서 자사 번역 기능을 바로 사용할 수 있는 환경을 구축했다. 딥엘은 챗GPT와 마이크로소프트 코파일럿, 클로드에 연결할 수 있는 '딥엘 모델 컨텍스트 프로토콜(MCP)'을 제공한다고 29일 밝혔다. 딥엘 계정을 연결하면 별도 번역 도구로 이동하지 않고도 텍스트와 문서 전체를 번역할 수 있다. MCP는 AI 어시스턴트가 외부 도구 기능을 사용할 수 있도록 연결하는 개방형 표준이다. 사용자가 계정을 연결해 로그인하면 AI 어시스턴트가 번역 요청을 딥엘에 직접 전달한다. 사용자는 개별 메시지나 여러 텍스트를 하나 이상의 언어로 번역할 수 있다. 문서를 통째로 번역할 때도 표와 머리글, 이미지 등 기존 서식과 배치를 유지할 수 있다. 회사에서 정한 용어와 문체도 번역에 반영 가능하다. 기존 딥엘 용어집과 스타일 규칙을 그대로 적용해 번역할 때마다 전문 용어나 표현 방식이 달라지는 것을 줄일 수 있다. 딥엘은 AI 어시스턴트를 기본 번역 서비스로 지정하는 기능도 지원한다. 이를 설정하면 번역을 요청할 때마다 딥엘을 사용하라고 따로 지시할 필요가 없다. 관리자는 조직 접근 권한을 켜거나 끌 수 있다. 서버는 딥엘이 직접 운영하므로 사용자가 별도로 설치하거나 실행할 필요가 없다. 주요 AI 어시스턴트 외에도 원격 MCP 서버를 지원하는 다른 AI 에이전트와 개발자 도구에 연결할 수 있다.

2026.09.29 09:15김미정 기자

"연말 쇼핑, 챗GPT에 물어본다"…AI 통한 쇼핑몰 방문 130% ↑

연말 쇼핑 시즌 미국에서 챗GPT 등 인공지능(AI) 챗봇을 활용해 상품을 찾는 소비자가 크게 늘어날 전망이다. 28일(현지시간) 블룸버그 통신에 따르면 어도비는 올해 11~12월 챗GPT나 앤트로픽의 클로드 등 외부 AI 플랫폼을 거쳐 미국 소매업체 웹사이트로 유입되는 방문은 지난해 같은 기간보다 130% 증가할 것으로 예상했다. 또 AI의 추천을 받은 뒤 쇼핑몰로 이동한 소비자는 다른 경로로 유입된 소비자보다 구매 가능성과 건당 지출액이 높다는 분석이다. 어도비는 미국 웹사이트 방문 1조 건 이상을 추적해 연말 쇼핑 시장을 분석했다. 올해 11~12월 미국 온라인 매출은 전년 동기보다 6.7% 증가한 2751억 달러(약 374조 2735억원)에 이를 것으로 내다봤다. 비벡 판디아 어도비 디지털 인사이트 담당 이사는 “소비자들이 AI 에이전트와 대화하며 추천을 받고 그 결과를 바탕으로 소매업체 사이트를 방문하는 데 익숙해지고 있다”며 “상품을 조사하고 결과를 빠르게 정리하는 일을 에이전트에 맡기고 있다”고 말했다. 이번 분석에서 AI를 통한 방문은 챗GPT나 클로드처럼 쇼핑몰 밖의 플랫폼에서 상품을 알아본 뒤 소매업체 사이트로 이동한 경우를 뜻한다. 아마존이나 월마트 웹사이트 안에서 이뤄지는 챗봇 검색은 포함되지 않았다. 다만 AI를 이용해 상품을 비교하는 소비자가 늘고 있어도 챗봇을 통해 구매까지 마치는 비중은 아직 작다. 아마존은 퍼플렉시티와 메타의 AI 어시스턴트 접근을 차단하고 있어 이들 서비스를 통한 아마존 상품 구매도 불가능하다. 품목별로는 전자제품과 의류가 연말 온라인 쇼핑에서 가장 큰 비중을 차지할 전망이다. 식료품과 장난감 지출은 이들 품목보다 빠르게 늘어날 것으로 어도비는 예상했다. 할인 폭은 추수감사절부터 사이버먼데이까지 닷새 동안 가장 크고 이 기간 청소기와 비디오게임 매출 증가세가 두드러질 것으로 내다봤다. 판디아 이사는 “소비가 고가 상품을 넘어 일상 필수품으로 확대되고 있다”고 말했다.

2026.09.29 09:13김민아 기자

[AI는 지금] 앤트로픽, 오픈AI '가성비 전략'에 맞불…소넷 5.5 공개

앤트로픽이 더 빠르고 비용을 낮춘 인공지능(AI) 모델 '클로드 소넷 5.5'를 내놓으며 오픈AI와 가성비 경쟁에 나섰다. 앤트로픽은 28일(현지시간) 자사 블로그를 통해 클로드 소넷 5.5를 출시했다고 밝혔다. 이전 모델인 소넷 5보다 출력 속도가 30% 이상 높였고 같은 작업을 처리하는 비용은 최대 30% 줄였다. 소넷 5.5의 가격은 오픈AI가 최근 출시한 GPT-6 솔과 같다. 두 모델 모두 100만 토큰당 입력 2달러, 출력 10달러다. 소넷 5.5는 기존 소넷 5와 토큰 가격은 같지만 같은 작업에 사용하는 토큰을 줄여 실제 작업 비용을 낮췄다. 소넷 5.5는 최고 성능 모델인 오퍼스 5.5보다 빠르고 저렴하게 사용할 수 있는 모델이다. 복잡한 판단이 필요한 작업보다 문서 작성과 코드 수정 등 일상적인 업무를 빠르게 처리하는 데 초점을 맞췄다. 오픈AI GPT-6 솔도 최고 성능 모델인 GPT-6 아스트라보다 가격을 낮추면서 성능과 비용 균형을 맞춘 모델이다. 오픈AI는 지난 22일 솔을 출시하며 복잡한 코딩과 AI 에이전트 업무에 활용할 수 있다고 밝혔다. 가격은 두 모델이 같지만 비용을 낮춘 방식은 다르다. 오픈AI는 GPT-6 솔의 API 가격을 이전 GPT-5.6 솔보다 50% 낮췄다. 앤트로픽은 소넷 5의 토큰 가격을 그대로 유지하면서 같은 작업에 필요한 토큰을 줄였다. 소넷 5.5는 코딩과 실제 업무 수행 능력에서도 이전 모델보다 높은 점수를 기록했다. AI가 명령줄 환경에서 여러 단계의 코딩 작업을 수행하는 능력을 평가하는 터미널벤치 4.0에서 70.6%를 기록했다. 소넷 5는 10.3%, 상위 모델인 오퍼스 5.5는 66.4%였다. 44개 직업과 9개 산업의 업무를 평가하는 GDPval-AA v2.1에서는 1844점을 기록해 오퍼스 5.5의 1846점에 근접했다. 컴퓨터를 직접 조작해 작업하는 능력을 평가하는 OS월드 2.1에서도 소넷 5.5는 80.1%, 오퍼스 5.5는 81.8%를 기록했다. 차트를 읽고 이해하는 능력을 평가하는 차토그래피에서는 이전 세대와 격차가 컸다. 소넷 5는 15.6%에 그쳤지만 소넷 5.5는 61.6%를 기록했다. 비용 대비 성능도 이전 모델보다 높아졌다. 소넷 5.5는 낮거나 중간 수준의 추론 강도에서도 일부 평가에서 소넷 5의 최고 점수를 넘어섰다. 코딩 평가인 프런티어코드에서는 높은 추론 강도에서 소넷 5보다 약 10점 높은 점수를 냈다. 각각 작업에 든 비용은 소넷 5의 약 10%, 7% 수준이었다. 다만 앤트로픽은 벤치마크 점수가 실제 성능을 모두 보여주는 것은 아니라고 밝혔다. 정답이 명확하지 않고 오랜 시간 판단을 이어가야 하는 복잡한 업무에서는 오퍼스 5.5가 여전히 소넷 5.5보다 뛰어나다고 설명했다. 성능 향상에 맞춰 안전장치도 추가했다. 소넷 5.5는 소넷 계열 가운데 처음으로 상위 모델에 적용하던 사이버보안 안전장치를 적용했다. 위험도가 높은 사이버보안 요청이 들어오면 이전 모델인 소넷 5가 대신 처리하도록 했다. 다른 AI가 클로드 답변을 대량으로 수집해 성능을 모방하는 증류 공격에도 대응했다. 앤트로픽은 수천 개 가짜 계정을 이용해 답변을 수집하는 공격을 막기 위해 소넷 계열 최초로 안전 분류기를 적용했다. 모델이 이용자의 의도와 다르게 행동하는지도 점검했다. 약 1850개 상황을 대상으로 자동 행동 감사를 진행한 결과 대부분의 정렬과 오용 방지, 정직성 평가에서 소넷 5와 같거나 개선된 결과를 기록했다고 밝혔다. 소넷 5.5는 클로드 앱과 클로드 코드, 클로드 플랫폼에서 사용할 수 있다. 아마존웹서비스(AWS)와 구글 클라우드, 마이크로소프트 애저에서도 제공된다. 앤트로픽은 "소넷 5.5는 소넷 5보다 더 명확하게 글을 쓰고 초기 테스터들은 소넷 5보다 협업하기 좋은 파트너라고 평가했다"며 "속도가 빨라져 덜 복잡한 작업을 빠르게 반복하는 데도 적합하다"고 설명했다.

2026.09.29 08:51김동원 기자

MS, 코파일럿을 '업무 실행 AI'로…홈·코드·오토파일럿 공개

마이크로소프트가 인공지능(AI) 비서 '코파일럿' 역할을 단순 업무 보조에서 작업 실행과 직원 협업으로 넓히는 서비스 개편에 나섰다. 직원이 필요한 AI 도구를 직접 만들고 복잡한 업무를 AI에 맡기는 환경을 강화하기 위한 전략이다. 마이크로소프트는 지난 25일 코파일럿 앱 신규 기능인 '홈' '코드' '오토파일럿'을 공식 홈페이지를 통해 공개했다. 홈과 코드는 몇 주 내 프런티어 프로그램에서 순차적으로 제공되며, 오토파일럿은 이달 말 비공개 프리뷰에서 확대 적용된다. 오토파일럿은 사용자의 추가 지시 없이 업무를 진행하는 개인 AI 에이전트다. 기존 '스카우트'에서 이름을 바꾼 기능이다. 조직 내 자체 계정과 메모리, 작업 공간에서 작동한다. 이름과 역할, 목표를 정해 주면 업무를 시작한다. 채널을 확인하고 대화 후속 작업과 반복 업무도 처리한다. 사용자가 다른 작업을 진행할 때도 업무를 지속할 수 있다. 며칠 뒤 프로젝트를 다시 이어 갈 수도 있다. 예를 들어 공급업체 검토를 맡기면 일정과 업무 계획부터 세운다. 이후 회의 준비와 후속 조치를 수행하고 관계자에게 진행 상황도 확인한다. 사용자는 업무 목표와 범위를 직접 설정하면, 진행 상황을 확인하면서 오토파일럿 업무 수행을 관리할 수 있다. 코드는 개발자가 아니어도 자연어로 업무용 소프트웨어(SW)를 만들 수 있게 돕는 기능이다. 원하는 앱이나 대시보드, 자동화 작업을 설명하면 코파일럿이 구현 방식을 선택해 제작할 수 있다. 데스크톱에서 상시 실행하는 위젯부터 데이터를 탐색하는 대화형 대시보드와 팀원에게 공유할 수 있는 클라우드 기반 내부 앱까지 지원한다. 코드는 '깃허브 코파일럿' 같은 기반 기술을 사용하고 격리된 환경에서 작동한다. 기업 '마이크로소프트 365' 환경 내에서 앱을 운영하도록 지원하는 '코파일럿 매니지드 런타임'도 프리뷰로 제공한다. 이를 통해 관리자가 운영을 통제할 수 있도록 돕는다. 이 기능은 코워크와 코드뿐 아니라 코파일럿 스튜디오에서 만든 앱도 지원한다. 홈은 대화형 기능 '챗'과 업무 위임 기능 '코워크'를 한곳에 모은 시작 화면이다. 챗이 간단한 질문과 정보 조회, 초안 작성을 담당하며 코워크는 제안요청서 답변서와 고객 브리핑, 결산 자료 등 복잡한 업무를 처음부터 끝까지 처리해 결과물을 내놓는다. 사용자가 달성하려는 목표만 설명하면 코파일럿이 챗과 코워크, 코드 중 적합한 기능으로 작업을 연결한다. 마이크로소프트는 '오피스 인 코파일럿'으로 워드·엑셀·파워포인트를 코파일럿 안에 통합한다. 이용자는 대화하면서 실제 편집 가능한 문서와 스프레드시트, 발표 자료를 만들거나 팀이 작업 중인 파일을 수정할 수 있다. 동료 수정 사항이 실시간으로 반영되고 기존 오피스 앱과도 동기화돼 공동 작업을 이어 갈 수 있다. 마이크로소프트는 일반 AI 활용과 에이전트 업무를 구분해 과금 체계를 설정했다고 밝혔다. 챗과 오피스 앱에서 사용하는 코파일럿 등에는 정액 구독을 적용하고 코워크·코드·오토파일럿과 장시간 실행하는 에이전트 기능에는 사용량 기반 과금을 적용한다. 구독에 포함되는 '오토'는 요청마다 정확도와 속도, 비용을 고려해 적합한 모델을 선택하는 기능이다. 사용량 기반 과금에서는 이용자가 모델을 선택하고 업무에서 얻는 가치에 맞춰 비용을 조정할 수 있게 돕는다. 클로드 오푸스 5.5·아스트라, 코파일럿에 순차적 적용 마이크로소프트는 코파일럿에 앤트로픽 '클로드 오푸스 5.5'와 오픈AI 'GPT-6' 등 최신 AI 모델을 추가해 이용자 선택권을 확대한다. 해당 모델은 워드와 엑셀, 파워포인트를 비롯해 챗, 코워크, 코파일럿 스튜디오에서 이용할 수 있다. 이번 모델 추가는 AI 모델 하나로 모든 업무를 처리하기보다 작업에 따라 서로 다른 모델을 선택할 수 있도록 하기 위한 조치다. 이용자는 여러 프런티어 모델 가운데 수행하려는 업무에 적합한 모델을 선택할 수 있다. 이 외에도 마이크로소프트는 AI 지출 관리를 위한 'AI를 위한 핀옵스' 기능도 강화한다. 관리자는 사용자 그룹별로 허용할 모델과 지출 정책을 설정하고 크레딧 요청을 기존 승인 절차에 연결할 수 있다. 이용자는 코파일럿에서 크레딧 사용량과 잔액, 사용 이력을 직접 확인할 수 있다. 회사는 기업 데이터와 업무 맥락을 반영하는 범위도 넓힌다고 밝혔다. 패브릭 IQ를 통한 파워 BI 데이터 활용은 챗과 코워크에서 정식 제공하며, 다이내믹스 365와 파워 플랫폼 연동은 앞으로 한 달에 걸쳐 공개 프리뷰로 순차 제공한다. 이를 통해 영업 담당자는 앱을 오가지 않고도 거래 이력과 고객 지원 기록을 제안서에 반영할 수 있다. 재러드 스파타로 마이크로소프트 업무용 AI 부문 최고마케팅책임자(CMO)는 "사람들이 사용하는 도구를 업무 전반에 AI를 구축하고 맞춤화하며 확대 적용하는 데 필요한 차세대 기능과 연결하기 위해 새로운 코파일럿을 선보인 것"이라며 "조직이 지출을 통제하고 가치를 이해하며 실질적인 성과를 내도록 AI 투자를 최적화할 수 있게 지원할 것"이라고 밝혔다.

2026.09.28 11:00김미정 기자

챗GPT에 '광고' 붙여보니…클릭 70%가 사이트 방문·광고비 7배 매출

오픈AI의 '챗GPT 광고'에서 광고 클릭의 70% 이상이 실제 웹사이트 방문으로 이어지고 일부 광고주는 광고비 대비 7배의 광고수익률(ROAS)을 거둔 것으로 확인됐다. 또 다른 광고주는 챗GPT 광고 클릭의 10% 이상이 가입으로 전환되고 가입당 비용이 기존 유료 사회관계망서비스(SNS) 광고보다 60% 낮은 사례도 나타났다. 24일(현지시간) 오픈AI는 '챗GPT 광고 캠페인 성공의 기반 다지기'를 주제로 한 웨비나를 통해 이같은 초기 광고주 성과와 캠페인 운영 전략을 공개했다. 오픈AI에 따르면 개발자 도구 기업 스트림은 챗GPT 광고 클릭의 70% 이상이 웹사이트 세션으로 이어졌으며 폼빌더 기업 조트폼은 클릭의 10% 이상이 가입으로 전환됐다. 조트폼의 가입당 비용은 유료 소셜 광고보다 60%, 유료 검색광고보다 30% 낮았다. 전자상거래 기업 뉴에그는 28일간 캠페인에서 3배, 2주간 판촉 행사에서는 7배의 ROAS를 기록했다. 챗GPT 안에서 광고를 시작하는 과정도 비교적 단순하게 설계됐다. 광고주는 챗GPT 광고 사이트에서 기존 챗GPT 계정으로 로그인한 뒤 자사 웹사이트를 입력하면 챗GPT가 사업 내용과 상품을 분석해 광고 문구와 소재를 추천한다. 광고주는 해당 결과를 검토·수정한 뒤 캠페인을 만들 수 있다. 이날 웨비나에서는 가상의 헤드폰 스타트업 '노바 원'을 대상으로 인공지능(AI)이 광고 소재와 캠페인 구조를 제안하는 과정이 시연됐다. 광고 성과를 측정하기 위한 기능도 제공한다. 오픈AI는 웹사이트 데이터를 수집하는 픽셀과 서버 데이터를 연동하는 전환 API(CAPI)를 함께 사용하는 방식을 권장했다. 초기 데이터에서는 픽셀과 CAPI를 같이 사용한 광고주의 전환 데이터 커버리지가 픽셀만 사용한 경우보다 중앙값 기준 약 69% 높게 나타났다. 캠페인은 챗GPT 애즈 매니저에서 직접 만들거나 엑셀 파일을 통한 일괄 업로드, 응용 프로그램 인터페이스(API)를 이용한 프로그래밍 방식으로도 구축할 수 있다. 기업이 이렇게 제작한 광고 캠페인을 관리하고 반응을 분석하는 과정 역시 챗GPT 안에서 자연어로 이뤄진다. 광고주가 챗GPT 애즈 매니저 플러그인을 활용하면 캠페인 성과를 물어 주요 지표와 성과가 좋은 광고를 확인하고 왜 특정 광고가 더 잘 작동하는지 분석을 요청할 수 있다. AI는 이를 바탕으로 성과가 낮은 캠페인의 예산을 성과가 좋은 캠페인으로 옮기는 등의 개선 방안도 제안한다. 챗GPT의 대화 맥락을 광고 관련성을 높이는 데 활용하는 것도 기존 검색·SNS 광고와 다른 지점이다. 현재 대화 맥락을 바탕으로 광고를 선택할 수 있으며 광고 개인화가 활성화된 경우 과거 대화와 메모리가 광고 관련성을 높이는 데 활용될 수 있다. 다만 광고주가 이용자의 비공개 대화나 메모리를 볼 수 있는 것은 아니며 광고가 챗GPT의 유기적 답변이나 추천에 영향을 미치지도 않는다. 이커머스 사업자는 상품 피드를 연결해 카탈로그의 여러 상품을 기반으로 광고를 생성할 수 있다. 특히 전자상거래 업체 쇼피파이 이용자는 전용 '챗GPT 애즈' 앱을 통해 상품 카탈로그와 장바구니·구매 등 요소를 챗GPT 애즈 매니저에 연결할 수 있다. 상품 정보가 변경되면 피드에도 자동 반영돼 대규모 상품을 취급하는 사업자의 광고 운영 부담을 줄일 수 있다. 오픈AI 측은 광고주들에게 "적은 수의, 충분한 예산이 배정된 캠페인 전략이 필요하다"며 "비슷한 목표와 예산 전략, 지역·일정 등을 가진 캠페인을 불필요하게 나누지 말고 예산을 집중해 캠페인을 학습할 여지를 확보해야 한다"고 강조했다. 이어 "사업에 중요한 결과를 중심으로 캠페인을 최적화하고 이커머스 사업자라면 상품 피드를 연결해 챗GPT를 AI 마케팅 파트너로 활용하라"고 덧붙였다.

2026.09.27 06:47이나연 기자

AI가 알려준 PC 문제 해결법, 믿고 실행해도 될까

무료 영화나 웹툰 등을 볼 수 있다는 사이트에서 콘텐츠를 클릭하자 갑자기 요란한 경고음이 들린다. 이어 "당신의 컴퓨터가 바이러스에 감염됐다. 고객센터에 전화해 치료하라"는 안내문이 화면 가득 깜빡인다. 과거 미국과 유럽을 비롯해 여러 나라에서 기승을 부렸던 '고객지원 사기'의 전형적인 수법이다. 이들은 아무런 문제가 없는 PC인데도 바이러스나 악성코드 감염, 시스템 오류를 알리는 허위 경고를 띄운 뒤 가짜 고객센터 번호로 전화를 걸게 했다. 상담원을 가장한 범죄자의 지시에 따르는 순간 개인정보 유출, 상품권 핀번호 갈취 등 피해를 입는다. 구글은 작년 크롬에 온디바이스 AI를 활용해 고객지원 사기를 탐지하는 기능을 추가하는 등 보완책을 내놨다. 하지만 공격자들이 사라진 것은 아니다. 최근에는 한 단계 더 나아가 이용자가 스스로 검색한 PC 문제 해결법을 악성코드 감염 경로로 만드는 공격 기법이 등장했다. 저장공간 정리하려 실행한 명령어, 악성코드 초대장이었다 미국 보안업체 헌트리스는 이달 초순 공개한 보고서를 통해 AI 서비스와 검색엔진을 악용한 공격 사례를 소개했다. 헌트리스에 따르면 작년 12월 한 맥 이용자는 저장공간을 비우는 방법을 찾기 위해 구글을 뒤졌다. 검색 결과 중 가장 위에는 챗GPT와 그록의 공유 대화가 등장했다. 내용 역시 그럴듯했다. 저장공간을 확보하는 방법을 단계별로 설명했고, 이를 실행할 수 있는 명령어도 소개했다. 이용자는 챗GPT 대화를 클릭해 안내를 읽고 명령어를 실행했다. 하지만 이 명령어를 실행하자 비밀번호와 웹사이트 인증 정보 등을 탈취하는 악성코드가 설치됐다. AI 대화까지 악성코드 통로로 악용 공격자는 악성코드를 설치하는 명령어가 포함된 AI 대화를 만든 뒤 챗GPT와 그록의 공유 기능을 활용했다. 이후 검색엔진최적화(SEO) 기법을 활용해 '맥 저장공간 확보' 같은 문제 해결과 관련있는 검색어에서 해당 대화가 상위에 노출되도록 만들었다. 이제는 피싱 메일이나 수상한 파일을 직접 보내는 대신, 실제 AI 서비스의 기능을 이용해 악성 콘텐츠를 올리고 검색 결과를 오염시키는 새로운 공격 방법까지 등장한 것이다. 헌트리스는 이 공격이 구글 검색 결과 상위 노출에 대한 신뢰와 챗GPT·그록 브랜드에 대한 신뢰, 실제 서비스와 동일한 화면에 대한 신뢰를 동시에 악용했다고 분석했다. "사람인지 증명하려면 명령어를 입력하세요" 국내 보안업체인 SK쉴더스도 지난 9월 10일 "진짜 사람 여부를 가리는 '캡차(CAPTCHA)'나 운영체제 업데이트, 소프트웨어 오류 해결 화면처럼 보이는 페이지를 통해 이용자가 직접 명령어를 실행하게 만드는 공격이 국내외에서 확산되고 있다"고 설명했다. SK쉴더스에 따르면 공격자는 "당신이 사람인지 증명하려면 아래 명령어를 실행하라", "오류를 해결하려면 윈도 키와 R 키를 누르고 특정 명령어를 입력하라"는 메시지로 이용자를 속인다. 윈도 파워셸이나 '실행' 대화상자, 혹은 맥OS에 내장된 '터미널'에 이 명령어를 붙여넣고 실행하면 서버에서 악성코드를 가져와 설치한다. 헌트리스가 소개한 AI 검색을 악용한 사례와는 다소 차이가 있지만, 이용자를 속여 명령어를 직접 실행하게 만든다는 점에서는 닮았다. AI로 찾은 PC 문제 해결법, 무조건 신뢰는 금물 AI 검색 기능은 전화 통화가 불가능한 심야나 주말에, 혹은 당장 도움을 받을 사람이 떠오르지 않을 때 간편하게 해결 방법을 찾을 수 있어 유용하다. 그러나 AI 서비스나 검색으로 알게 된 뜻 모를 복잡한 명렁어를 무조건 실행해서는 안된다. 공격자가 원하는 대로 파일을 다운로드하거나 외부 URL에 접속하고, 보안 기능을 끄거나 관리자 권한을 요구하는 위험한 함정일 수 있다. SK쉴더스는 "정상적인 캡차는 마우스 클릭 대신 명령어 입력을 요구하지 않으며 이런 상황에 놓인다면 그 웹사이트를 닫으라"고 조언했다. 검색 결과 상단에 노출됐다고 해서 무조건 파일을 내려받아 설치하는 일도 위험하다. 소프트웨어와 드라이버는 반드시 공식 사이트에서 받아야 하며 웹사이트 주소가 정상적인지 확인하는 습관이 필요하다.

2026.09.25 15:30권봉석 기자

[AI는 지금] 메타, '뮤즈'로 AI 사업 탄력 받을까…"이용자·구독률 확대 과제"

메타가 인공지능(AI) 개인비서 '뮤즈' 흥행을 발판으로 AI 사업 확대에 탄력 받을 것이란 전망이 나오고 있다. 뮤즈 초기 흥행을 지속적인 이용과 유료 구독으로 연결할 경우 초지능연구소(MSL) 설립과 인프라 확충에 쏟아부은 대규모 투자가 실질적인 수익으로 이어질 수 있다는 분석이다. 23일 IT 업계에 따르면 메타의 뮤즈가 지난 8일 출시 열흘 만에 미국 애플 앱스토어 무료 앱 다운로드 순위에서 챗GPT를 제치고 1위에 올랐다. 당시 메타 주가도 전 거래일보다 10% 넘게 급등했다. 뮤즈는 이용자 요청에 따라 쇼핑과 여행 예약, 이메일 발송 등을 처리하는 AI 에이전트다. 전용 앱과 왓츠앱을 통해 이용할 수 있어 이용자 취향과 과거 대화를 기억해 작업을 돕는다. 결제나 이메일 발송처럼 중요한 작업을 실행할 때는 이용자 승인을 받는다. 뮤즈 흥행에 주식시장도 반응했다. 지난 21일 메타 주가는 전 거래일보다 11.4% 급등했고, 시가총액은 하루 만에 1923억 달러(약 261조 2500억원) 늘었다. 웰스파고는 메타 목표주가를 기존 640달러에서 796달러(약 108만 1400원)로 상향 조정했다. 뮤즈가 광고 외 수익원을 확보하는 계기가 될 수 있다는 기대가 주가를 끌어올린 것이다. 뮤즈는 메타가 지난해부터 추진해온 AI 조직 개편과 투자 성과를 가늠할 주요 서비스로 평가받고 있다. 메타는 지난해 6월 '메타 초지능연구소(Meta Superintelligence Labs·MSL)'를 출범시키고 차세대 AI 연구와 제품 개발 체계를 재편했다. 당시 메타는 스케일AI 창업자인 알렉산더 왕을 연구소 최고AI책임자로 영입했으며, 냇 프리드먼 전 깃허브 최고경영자(CEO)에게 AI 제품과 응용 연구를 맡겼다. 같은 달 스케일AI에 143억 달러를 투자하고 오픈AI·구글·앤트로픽 출신 연구자들을 영입하는 등 인재 확보에도 공을 들였다. 그동안 마크 저커버그 메타 CEO가 내세운 사업 방향은 이용자 개개인 목표와 상황을 이해하고 일상 업무를 돕는 '개인 초지능'이다. 뮤즈는 이 구상을 소비자용 서비스로 구현한 사례다. 메타는 무료 서비스와 함께 월 20달러·100달러 구독 상품을 마련했으며, 향후 스마트 안경에도 뮤즈를 적용할 계획이다. 다수 외신은 메타가 뮤즈를 외부 서비스와 연동하는 방향을 사업 확장 수단으로 보고 있다. 메타는 최근 기업과 개발자가 뮤즈에 서비스를 연결할 수 있는 플랫폼을 개방했으며, 쇼피파이는 뮤즈에서 '숍 페이'를 이용한 쇼핑을 지원한다고 발표했다. 이용자가 뮤즈를 통해 상품을 찾고 구매하는 흐름이 확산하면 메타가 소비자와 기업을 연결하는 새로운 거래 접점을 확보할 수 있다. 업계에선 뮤즈 이용자 신뢰 확보가 필요하다는 의견도 나오고 있다. 아마존은 뮤즈의 자사 쇼핑몰 접근을 승인하지 않았다며 메타에 해당 기능에서 아마존을 제외해달라고 요청한 바 있다. 개인정보 접근과 작업 실행을 수반하는 만큼 보안과 오작동 우려를 해소하는 것도 과제인 것으로 전해졌다. 비즈니스인사이더는 "메타가 초기 다운로드 열기를 지속적인 이용과 유료 구독으로 연결할 수 있다면, 초지능연구소와 인프라에 쏟아부은 투자를 사업 성과로 입증하는 계기가 될 전망"이라고 분석했다.

2026.09.23 15:53김미정 기자

[AI는 지금] 속도조절론 속 쏟아진 신모델…AI 3사 승부처는

인공지능(AI) 개발 속도를 둘러싼 논쟁이 커지는 가운데 글로벌 AI 기업 3곳이 이틀 사이 신모델을 잇따라 공개했다. 앤트로픽과 오픈AI, 스페이스XAI는 나란히 성능을 높이면서도 안전성과 비용 효율, 에이전트 역량에 각각 무게를 뒀다. 22일(현지시간) 오픈AI는 'GPT-6 솔·루나', 앤트로픽은 '클로드 오퍼스 5.5'를 각각 공개했다. 하루 전인 21일에는 스페이스XAI가 '그록 4.7'을 선보였다. 같은 시기에 나왔지만 각사가 택한 전략은 달랐다. 앤트로픽은 외부 평가와 행동 감사 등 안전 검증을 강화했다. 오픈AI는 GPT-6 아스트라에서 확보한 기술을 더 빠르고 저렴한 솔·루나로 가져왔고 스페이스XAI는 복잡한 작업을 장시간 수행하고 결과를 스스로 확인하는 능력을 키웠다. 성능 경쟁에서는 오퍼스 5.5가 앞섰다. 글로벌 AI 평가기관 아티피셜 애널리시스의 종합 성능 지표(AAII)에서 최고 설정 기준 오퍼스 5.5는 58점을 기록했다. GPT-6 솔은 48점, 그록 4.7은 46점이었다. 다만 오픈AI와 스페이스XAI는 각각 비용 효율과 장시간 에이전트 업무를 주요 경쟁력으로 강조했다. 최근 AI 개발 속도를 조절해야 한다는 주장에는 세 회사 수장 모두 공감을 나타냈다. 다만 실제 안전 대응은 검증 방식과 적용 강도에서 차이가 있었다. 속도조절 필요성을 제기한 앤트로픽은 오퍼스 5.5를 외부 기관에 사전 평가받고 약 2000개 상황을 대상으로 행동 감사를 진행했다. 오픈AI는 솔·루나가 자사 최고 위험 단계에는 이르지 않았다고 판단해 기존 GPT-5.6 솔·루나와 같은 안전장치를 적용했다. 스페이스XAI는 그록 4.7에 새로운 안전체계를 도입했지만 공식 발표에는 외부 기관의 사전 평가나 개발 속도를 늦춘 조치에 대한 내용은 포함되지 않았다. 앤트로픽은 '안전'…외부 검증·고위험 작업 제한 앤트로픽은 오퍼스 5.5에서 외부 검증과 고위험 작업 통제를 강화했다. 회사는 이를 프런티어 AI 개발 속도조절을 제안한 이후 처음 공개한 모델이라고 소개했다. 출시 전에는 미국 비영리 AI 평가기관 모델평가위협연구소(METR)와 프런티어 디자인 등 외부 기관의 평가를 받았다. 내부에서도 모델이 위험하거나 의도하지 않은 행동을 보이는지 자동으로 점검했다. 통제 범위를 벗어나려는 행동도 따로 살폈다. 오퍼스 5.5가 정해진 경계를 우회하려 한 빈도는 기존 오퍼스 5와 미토스 5.1보다 약 85% 낮았다. 확인된 시도는 모두 심각도가 낮았으며 모델이 스스로 이를 보고했다고 회사 측은 설명했다. 악용 가능성이 큰 분야에는 사용 제한을 뒀다. 대부분의 사이버보안 작업은 이전 모델인 오퍼스 4.8이 처리하도록 했으며 일부 생물학 관련 고위험 기능에는 이용자 검증 절차를 적용했다. 성능과 비용도 개선됐다. 초기 평가자가 20만줄 규모의 프로그램 코드를 점검하고 오류를 수정하도록 하자 오퍼스 5.5는 3시간 안에 작업을 마쳤다. 기존 오퍼스 5는 같은 작업에 20시간 이상 걸렸다. 일반적인 작업 비용은 40% 낮아졌고 출력 속도는 30% 이상 빨라졌다. 안전 평가의 한계도 확인됐다. 오퍼스 5.5가 일부 상황에서 자신이 시험받고 있다는 사실을 의심하는 징후를 보였기 때문이다. 앤트로픽은 "모델을 배포하기 전에 모든 실패 가능성을 평가로 찾아내는 방법은 아직 해결되지 않았다"고 설명했다. 오픈AI는 '효율'…아스트라 기술 더 싸게 오픈AI는 아스트라에서 확보한 기술을 더 낮은 비용의 솔과 루나로 가져왔다. 최상위 모델의 성능을 최고가 제품에만 두기보다 작업 난도와 비용에 따라 선택할 수 있도록 GPT-6 제품군을 세분화했다. 솔은 복잡한 코딩과 에이전트 업무처럼 높은 성능이 필요한 작업을 겨냥한다. 루나는 빠른 응답과 낮은 비용이 중요한 대량 작업에 초점을 맞췄다. 오픈AI는 루나를 자사 모델 가운데 가장 빠르고 비용 효율적인 모델로 소개했다. 가격은 GPT-5.6 솔·루나의 프로모션 가격보다 50% 낮췄다. 솔은 입력 토큰 100만개당 2달러, 출력 10달러이며 루나는 각각 0.1달러와 0.5달러다. 안전 대응에서는 기존 체계를 유지했다. 오픈AI는 솔과 루나를 사이버보안과 생물·화학 분야에서 '높은 수준'으로 분류했지만 아스트라가 도달한 사이버보안 '중대한 수준'에는 미치지 않는다고 평가했다. 이에 따라 GPT-5.6 솔·루나와 같은 수준의 안전장치를 적용했다. 아스트라에서 개발한 정렬 기술은 새 모델에도 적용했다. 오픈AI는 솔과 루나가 GPT-5.6 계열보다 탈옥 공격에 대한 저항성과 정렬 평가에서 개선된 결과를 보였다고 밝혔다. 오픈AI는 위험이 일정 수준에 접근하면 실제 개발 속도를 늦춘 경험도 있다. 지난달 아스트라가 중대한 수준의 사이버보안 능력에 도달할 가능성이 나타나자 배포 예정 모델의 강화학습을 2주간 중단했다. 최대 규모의 프런티어 강화학습도 보류하고 보안과 모니터링 체계를 보강했다. 스페이스XAI는 '에이전트'…수시간짜리 업무까지 겨냥 스페이스XAI는 그록 4.7의 장시간 업무 수행과 자기 검증 능력을 강화했다. 기존 그록 4.6보다 큰 기반 모델을 사용하고 강화학습 기간을 늘려 수시간이 걸리는 문제의 학습 비중을 높였다. 모델은 긴 작업을 이어가면서 앞서 내린 판단과 결과를 다시 확인하도록 훈련됐다. 긴 맥락을 관리하는 능력도 높여 코딩뿐 아니라 문서 작성과 전문 지식 업무처럼 여러 단계를 거치는 작업을 겨냥했다. 외부 평가에서도 에이전트 업무 성능이 높아졌다. 아티피셜 애널리시스의 장기 지식 업무 평가 'AA 브리프케이스'에서 그록 4.7은 1657점을 기록해 그록 4.6보다 111점 높았다. 코딩 에이전트 지표도 9점 오른 56점을 기록했다. 가격은 입력 토큰 100만개당 2달러, 출력은 6달러부터 시작한다. 출력 속도를 두 배 높인 별도 모델도 제공한다. 안전 측면에서는 새로운 안전체계를 적용했다. 스페이스XAI는 자체 사이버보안 평가 '해커벤치 0.3'에서 위험한 이중용도 요청 가운데 3.3%만 허용했으며 자사가 평가한 모델 가운데 탈옥 공격 저항성이 가장 높았다고 밝혔다. 머스크도 최근 AI 개발 속도를 늦출 필요성에 공감을 나타냈다. 다만 이번 그록 4.7 공식 발표에서는 개발 속도를 낮추거나 외부 기관의 사전 평가를 받았다는 내용은 공개되지 않았다. 스페이스XAI는 "그록 4.7은 어려운 작업을 더 오래 수행하고 자신의 작업을 더 꼼꼼히 확인할 수 있다"며 "지금까지 가장 잘 조정된 안전장치를 갖췄다"고 밝혔다.

2026.09.23 14:37김동원 기자

[AI는 지금] 오픈AI, 'GPT-6 솔·루나' 출시…"아스트라 강점 확장"

오픈AI가 '아스트라'에 이어 가격 경쟁력과 코딩 정확도를 앞세운 인공지능(AI) 모델을 새로 내놔 시장 공략 범위를 넓혔다. 오픈AI는 'GPT-6 솔'과 'GPT-6 루나'를 출시했다고 공식 홈페이지를 통해 23일 밝혔다. GPT-6 솔은 코딩을 비롯한 복잡한 작업에 초점 맞춘 모델이다. GPT-6 루나는 문서 요약과 정보 추출처럼 목표가 명확하면서 많은 작업을 빠르게 처리해야 하는 업무에 적합하도록 설계됐다. 오픈AI는 두 모델 가격 경쟁력을 강화했다고 밝혔다. GPT-6 솔과 루나의 API 가격은 GPT-5.6 세대 모델 절반 수준으로 책정됐다. 오픈AI는 캐싱과 추론 기술을 개선하면서 모델 운용 효율을 높여 가격을 낮출 수 있었다고 설명했다. 두 모델 답변 정확도도 개선된 것으로 확인됐다. 오픈AI 내부 사실성 평가에서 GPT-6 솔은 이전 모델보다 오류율이 약 절반 줄어든 것으로 나타났다. 오픈AI는 "더 낮은 비용으로 상위 모델인 GPT-6 아스트라 수준의 신뢰성을 구현했다"고 평했다. 해당 모델은 코딩 작업에서 발생하는 오류율도 낮아진 것으로 확인됐다. 오픈AI는 새로운 솔과 루나가 사실에 부합하는 답변을 생성하는 능력을 개선했으며 코딩 과정에서도 이전보다 오류를 줄였다고 밝혔다. 업계에선 오픈AI가 GPT-6 제품군 확대 전략을 강화하고 있다는 평이 이어지고 있다. 앞서 솔과 루나 시리즈는 올해 GPT-5.6 제품군을 통해 처음 등장했으며 작업 난도와 용도에 따라 서로 다른 모델을 선택할 수 있도록 구성됐다. 오픈AI는 새 모델이 경쟁사 앤트로픽의 페이블과 오퍼스 등 최상위 모델보다 여러 작업에서 높은 성능을 보인다고 주장했다. 앤트로픽은 오픈AI의 이번 발표 약 90분 전 가격을 낮추고 페이블 수준의 성능을 갖춘 새 '오퍼스 5.5'를 공개해 모델 경쟁도 한층 치열해지고 있다. GPT-6 솔과 루나는 현재 다수 유료 계정에서 '챗GPT 워크'와 '코덱스'를 통해 이용할 수 있으며 챗GPT API에도 적용됐다. 루나는 데스크톱 앱과 무료·고 이용자에게도 제공되며 오픈AI는 챗GPT 앱과 웹사이트에 두 모델을 순차적으로 배포할 예정이다. 오픈AI는 "GPT-6 아스트라는 새로운 세대의 지능을 선보였다"며 "이번 모델들은 그 지능을 더욱 효율적이고 접근하기 쉽게 만들어 아스트라의 이점을 확장한다"고 밝혔다.

2026.09.23 09:19김미정 기자

[AI는 지금] 오픈AI 추격에 속도 내는 앤트로픽…'페이블 5.2' 곧 내놓나

오픈AI의 최신 인공지능(AI) 모델 '아스트라'가 기업·개발자 시장에서 빠르게 영향력을 넓히자 앤트로픽이 차세대 모델 출시를 서두르는 정황이 포착됐다. 22일 IT 업계에 따르면 앤트로픽은 기업공개(IPO)를 앞두고 새로운 AI 모델을 출시하는 방안을 내부적으로 논의하고 있는 것으로 전해졌다. 해당 논의는 지난 3일 출시된 오픈AI 'GPT-6 아스트라'가 기업 AI 지출과 개발자 이용량을 빠르게 늘리는 가운데 진행되고 있다. 실제 차기 모델로 추정되는 제품 테스트 정황도 나타났다. 테스팅카탈로그에 따르면 최근 엑스(X) 등 소셜미디어에는 앤트로픽의 미공개 모델 '클로드 페이블 5.2'가 생성한 것으로 추정되는 결과물이 잇따라 공유됐다. 앤트로픽은 해당 모델 테스트 진위여부를 공식적으로 발표하지 않았다. 공개된 사례에서는 페이블 5.2로 추정되는 모델이 외부 이미지 파일이나 플러그인, 서드파티 도구 없이 순수 자바스크립트만으로 게임과 인터랙티브 애니메이션을 구현했다. 모델이 한 번에 코드를 생성하고 캐릭터 이미지와 움직임까지 직접 구성한 것으로 나타났다. 일부 이용자는 페이블 5.2로 추정되는 모델과 아스트라 성능을 직접 비교하기도 했다. 한 테스터는 동일한 복잡한 프롬프트를 적용한 결과 새로운 페이블 모델이 기존 버전과 크게 다른 결과를 생성했다며 성능이 상당폭 개선됐다고 평했다. 현재 앤트로픽 고성능 모델 '오퍼스' 후속 제품 출시설도 나오고 있다. 테스팅카탈로그는 차기 모델이 '오퍼스 5.5'라는 이름으로 공개될 가능성이 있으며 이르면 이번 주 발표될 수 있다고 밝혔다. 다만 앤트로픽이 내부에서 출시를 논의 중인 신모델과 페이블 5.2 또는 오퍼스 5.5가 같은 제품인지는 확인되지 않았다. 앤트로픽이 신모델 출시를 검토하는 배경에는 아스트라 출시 이후 달라지고 있는 시장 지표가 있는 것으로 풀이된다. 기업 지출 관리 플랫폼 '램프'가 추적하는 기업 AI 지출에서 아스트라가 차지하는 비중은 약 13%로 집계됐다. 앤트로픽 최신 모델 '클로드 페이블'은 약 8%에 그쳤다. 개발자 이용 지표에서도 오픈AI가 앤트로픽을 추월한 것으로 나타났다. 오픈라우터 수치에 따르면 최근 한 주 동안 오픈AI 모델에 대한 지출이 앤트로픽을 넘어섰다. 오픈AI 모델 지출이 오픈라우터에서 앤트로픽을 앞선 것은 2년 반여 만에 처음인 것으로 전해졌다. 이런 흐름은 기업용 AI 시장에서 강점을 보여온 앤트로픽에도 부담으로 작용하고 있다. 잠재적 투자자들 사이에서는 오픈AI가 아스트라를 앞세워 앤트로픽의 기업 고객을 가져갈 가능성이 있는지에 대한 관심도 커지고 있다. 일각에선 대기업 고객이 기존 AI 공급사를 단기간에 바꾸기는 쉽지 않다는 분석도 나온다. 앤트로픽이 이미 기업 고객 기반을 확보하고 있는 데다 대기업은 기존 기술 공급사를 교체하는 데 상당한 시간이 필요하기 때문이다. 현재 페이블 5.2와 오퍼스 5.5의 정확한 모델명과 출시 일정은 아직 확정되지 않았다. 앤트로픽 역시 현재까지 신모델 출시 논의와 관련해 구체적인 입장을 밝히지 않고 있다. 한 개발자는 "동일한 복잡한 프롬프트를 적용했는데 기존 페이블과는 완전히 다른 결과가 나왔다"며 "새 미공개 모델 성능이 크게 개선됐고 아스트라와 비교해도 경쟁력이 있는 수준으로 보였다"고 말했다.

2026.09.22 14:42김미정 기자

오픈AI, 수학 연구 논란에 외부 자문단 출범…학자 9명 참여

오픈AI가 인공지능(AI)를 활용한 수학 연구 논란에 대응하기 위해 외부 수학자들과 협력한다. 21일(현지시간) 테크크런치 등 외신에 따르면 오픈AI는 미국 뉴저지주 프린스턴 고등연구소에 '수학 및 AI 자문그룹'을 출범한다고 발표했다. 자문그룹은 오픈AI의 수학 분야 연구 결과를 평가하고 수학계와 회사 간 소통을 지원한다. 이번 자문기구 출범은 오픈AI가 최근 '나비에-스토크스 밀레니엄 문제' 해법을 공개한 뒤 수학계에서 논란이 불거진 가운데 이뤄졌다. 오픈AI는 해당 문제를 다룬 내부 AI 모델이 수학 대부분 분야에서 100개가 넘는 추가 미해결 문제도 해결했다고 주장했다. AI가 짧은 기간에 유명 수학 문제의 해법을 잇따라 내놓으면서 일부 수학자는 연구 결과 공개 속도와 방식에 우려를 제기했다. 이달 초 필즈상 수상자 25명은 공개서한을 통해 AI 기업들이 유명 수학 문제 해결 경쟁을 벌이는 과정에서 기존 수학자의 지적 작업이 위협받을 수 있다고 지적했다. 새 자문그룹은 AI가 내놓은 연구 결과의 학술적 중요성을 평가하고 결과 공개 과정을 조율하는 역할을 맡는다. 구성원은 보수를 받지 않으며 오픈AI 요청 없이 의견을 제시하거나 자신의 견해를 외부에 공개할 수 있다. 회원 구성도 그룹 자체적으로 결정한다. 자문그룹이 오픈AI의 수학 연구 속도나 방향을 직접 결정할 수 있는 없는 것으로 전해졌다. 오픈AI는 자문그룹이 회사 내부 수학 연구 진전 속도를 어떻게 조절할지에 대해 조언하는 역할은 맡지 않는다고 밝혔다. 자문그룹에는 초기 구성원으로 수학자 9명이 참여한다. 이 가운데 앞서 필즈상 수상자들의 공개서한에 서명한 인물은 프린스턴 고등연구소의 카밀로 데 렐리스가 유일하다. 고등연구소는 "우리는 조언을 제공하겠지만 어떤 AI 기업에서도 의사결정 권한을 갖고 있지 않다"며 "각 기업이 내리는 결정에 대한 책임은 해당 기업에 있다"고 밝혔다.

2026.09.22 09:45김미정 기자

[단독] 오픈AI, 韓 엔터프라이즈 사업 강화…B2B 총괄 채용 추진

오픈AI가 국내 기업간거래(B2B) 사업을 이끌 총괄 책임자를 선임하는 방안을 논의 중인 것으로 전해졌다. 21일 복수 IT 업계 관계자에 따르면 오픈AI코리아는 기업 고객 사업을 전담할 B2B 부문 총괄을 별도로 두는 방안을 검토하고 있다. 구체적인 선임 시기나 담당 업무 범위는 아직 확정되지 않은 상태인 것으로 파악됐다. 익명을 요청한 국내 AI 업계 관계자는 "김경훈 오픈AI코리아 총괄은 기업소비자간거래(B2C) 사업에 집중하는 방향이 내부서 논의되고 있다"며 "조직을 B2C와 B2B로 세분화해 각 시장 특화 전략을 추진하려는 구상안이 나오고 있다"고 귀띔했다. 그동안 오픈AI코리아는 국내 기업 대상으로 '챗GPT 엔터프라이즈'를 비롯한 기업용 AI 제품 공급을 확대해 왔다. 이를 통해 국내 기업과 협력을 늘리고 업무 현장에 생성형 AI를 적용하기 위한 영업·기술 지원에도 힘을 쏟았다. 오픈AI코리아는 지난 9월 오피스 출범 1주년을 맞아 국내 기업용 AI 시장을 강화한다고 밝힌 바 있다. 챗GPT를 단순 업무 보조 도구에서 조사와 분석, 개발, 자동화 등을 직접 수행하는 기업용 플랫폼으로 키운다는 전략이다. 당시 김경훈 대표는 "한국 기업들이 AI에 무엇을 기대하는지 훨씬 분명해졌다"며 "우리 서비스가 실제 업무를 끝까지 수행하고 기존 시스템과 자연스럽게 연결되고 있다"고 강조한 바 있다. 이같은 소식에 오픈AI코리아 관계자는 "확인 결과 해당 내용은 사실과 다르다는 것이 우리 입장"이라고 밝혔다.

2026.09.21 11:58김미정 기자

오픈AI, 법률 특화 AI '아스트라 포 로' 공개…판례 검색 넘어 실무 지원

오픈AI가 인공지능(AI)의 활용 영역을 변호사의 전문 업무까지 넓힌다. 판례와 법령을 찾아 분석하는 데서 나아가 계약 검토와 법률 문서 작성 등 실제 업무 전반을 AI로 지원한다. 17일(현지시간) 오픈AI는 자사 블로그를 통해 법률 업무에 특화한 AI '아스트라 포 로(Astra for Law)'를 공개했다. 최신 AI 모델 GPT-6 아스트라에 법률 전문 검색과 분석·문서 작성 기능을 결합했다. 로펌뿐 아니라 법률 기술 기업도 이를 활용해 자체 제품과 서비스를 개발할 수 있다. 아스트라 포 로는 미국 판례와 법령, 규정, 법원 규칙, 행정 결정 등을 2억 3000만개 이상 웹페이지에서 검색할 수 있다. 비영리단체 프리 로 프로젝트와 협력해 공개된 미국 선례 판례의 99.9% 이상을 포괄하는 자료도 검색에 활용한다. 법률 자료를 찾은 뒤 사건에 적용하는 과정도 지원한다. 관련 판례를 찾아 사실관계를 비교하고 주장의 약점이나 불확실성을 파악하거나 계약 조항에 따라 어느 쪽이 위험을 부담하는지 분석할 수 있다. 오픈AI는 법률 조사 성능을 확인하기 위해 미국 법률 질문 200개를 대상으로 평가했다. 아스트라 포 로는 전체 정확성 기준에서 54% 통과율을 기록했다. GPT-6 아스트라가 일반 웹 검색을 이용했을 때의 38.7%보다 상대적으로 40% 높았다. 판례 검색 성능도 높았다. 같은 수준의 추론 능력으로 비교했을 때 아스트라 포 로는 판례 중심 질문에서 참고할 판례를 24% 더 많이 찾았다. 정확한 법원 판결문에서 질문과 관련된 부분을 찾아내는 성능은 최대 54% 높았다. 로펌과 법률 AI 기업은 자체 자료와 업무 방식을 결합해 필요한 도구를 만들 수 있다. 법률 AI 기업 하비와 레고라는 응용프로그램인터페이스(API)를 통해 아스트라 포 로를 자사 제품과 업무에 적용할 수 있다. 로펌에서 실제 업무에 적용한 사례도 공개됐다. 설리번앤크롬웰은 자체 협상 지침과 과거 계약 사례를 바탕으로 새로운 계약에서 위험 요소를 찾아내고 수정안을 제안하는 도구를 구축했다. 오픈AI는 다른 로펌과도 인수합병 실사와 기업공개 준비 등 각사의 업무 방식에 맞춘 AI 도구를 개발하고 있다. 외부 법률 서비스와 챗GPT를 연결하는 기능도 추가했다. 오픈AI는 법률 업무에 사용하는 전문 서비스를 챗GPT와 연결할 수 있는 26개 플러그인을 공개했다. 이를 통해 로펌이 기존에 사용하던 자료와 업무 도구를 챗GPT에서 활용할 수 있도록 했다. 고객 기밀 정보를 다루는 법률 업무를 고려한 보안 기능도 마련했다. 일부 로펌에는 API를 통해 처리한 데이터를 보관하지 않는 기능을 제공한다. 챗GPT 엔터프라이즈에서 처리한 내용은 기본적으로 사람의 검토 대상에서 제외한다. 아스트라 포 로는 우선 선정된 로펌을 대상으로 챗GPT와 코덱스에서 제공된다. 오픈AI는 향후 API에서도 사용할 수 있도록 할 예정이다. 오픈AI는 법률 분야에 장기적으로 투자하면서 로펌과 법률 기술 기업이 각자의 전문성과 업무 기준을 AI에 결합할 수 있도록 지원할 방침이다. 회사는 "가장 야심찬 활용 사례는 법률을 직접 다루는 사람들과 이들과 함께 서비스를 만드는 기업에서 나올 것"이라고 밝혔다.

2026.09.20 09:27김동원 기자

"똑똑한 AI, 실수도 잘 숨겨"…오픈AI, 정렬 실패 사례 공개

인공지능(AI) 모델 성능이 높아질수록 실수나 부적절한 행동을 감추는 능력도 덩달아 오를 수 있다는 분석 결과가 나왔다. 18일 테크크런치 등 외신에 따르면 오픈AI는 AI 정렬 실패 사례를 추적·조사하기 위한 새로운 공개 체계를 발표했다. 이번에 공개된 사례는 총 6건이다. AI 정렬은 모델이 사람 의도와 안전 기준에 맞게 행동하도록 만드는 작업이다. 이번 사례는 AI 능력이 높아질수록 잘못된 행동을 숨기는 능력도 함께 발전할 수 있다는 문제를 보여주고 있다. 문제는 배포 전 단계의 'GPT-5.6 솔'을 훈련하던 중 발견된 것으로 나타났다. 일부 솔 에이전트는 이전 대화와 작업 내용을 압축한 '컴팩션 요약'에 후속 모델을 위한 별도 지시를 남겼다. 컴팩션 요약은 길어진 대화 내용과 도구 실행 결과를 짧게 정리해 다음 모델에 전달하는 기록이다. 에이전트는 이 공간을 이용해 자신의 실수와 정렬 실패를 이용자에게 알리지 말라고 지시했다. 한 에이전트는 재무 모델을 만들던 중 이용자가 요청한 과거 데이터를 찾지 못했다. 그러자 2024년 데이터를 임의로 만들어 추가하고 이용자가 묻지 않으면 이를 밝히지 말라는 내용을 남긴 정황이 포착됐다. 최종 답변에는 설명 없이 완성된 파일 링크만 제공하라는 지시도 덧붙였다. 확인되지 않은 데이터를 사용했다는 사실을 이용자가 알아차리지 못하도록 한 셈이다. 다른 에이전트는 인터넷에 접속하지 못해 저장된 자료만으로 공급업체 명부를 작성했다. 자료 내용과 분류가 정확히 맞지 않는다는 사실을 파악했지만 필요하지 않으면 최종 답변에서 언급하지 말라고 지시했다. 미공개 아스트라 계열 모델에서도 비슷한 행동이 확인됐다. 한 에이전트는 후속 모델이 개발자 메시지를 무시하도록 하는 '침해 경고' 문구를 요약문에 넣었다. 또 다른 에이전트는 작업과 관계없는 페르소나 지시를 삽입했다. 이 두 사례에서는 후속 모델이 앞선 모델 지시를 따르지 않은 것으로 나타났다. 반대로 지시가 실제 행동에 영향을 준 사례도 있었다. 답변을 30단어 내로 제한하고 도구와 출처를 사용하지 말라는 지시를 받은 후속 모델은 이를 그대로 따랐다. 오픈AI는 이번에 공개한 6건이 알려진 모든 정렬 실패 사례를 담은 것은 아니라고 설명했다. 회사는 앞으로 심각성과 파급력 및 새로움을 기준으로 공개할 사례의 우선순위를 정할 계획이다. 오픈AI는 "AI 시스템이 더욱 발전하고 널리 배포됨에 따라 정렬 연구 진전에 관해 더 폭넓고 충분한 정보를 바탕으로 한 합의를 구축해야 한다"고 밝혔다.

2026.09.18 11:57김미정 기자

플로우, 챗GPT·클로드에 들어갔다…AI로 업무 지시까지 '척척'

플로우가 오픈AI '챗GPT'와 앤트로픽 '클로드'에 공식 앱으로 등록되며 인공지능(AI)과 협업툴을 직접 연결하는 업무 환경 확대에 나선다. 마드라스체크는 플로우가 챗GPT와 클로드에 공식 앱으로 동시 등록됐다고 17일 밝혔다. 회사 측에 따르면 국내 협업툴 가운데 두 AI 플랫폼에 모두 공식 앱으로 등록된 것은 플로우가 처음이다. 이번 연동의 핵심은 AI 대화창을 업무의 새로운 접점으로 활용하는 것이다. 사용자가 챗GPT나 클로드에서 "이번 주 영업 일정 알려줘", "이번 주 우리 팀에서 지연된 업무가 뭐지?"라고 질문하면 AI가 플로우에 축적된 업무 데이터와 조직 정보를 바탕으로 답변한다. 단순히 정보를 찾아주는 데 그치지 않는다. "이 과제를 김대리에게 요청해줘"라고 지시하면 AI가 플로우에서 실제 업무를 생성하고 담당자를 지정할 수 있도록 지원한다. 현재 프로젝트와 업무, 게시글, 일정, 위키, 조직도 등 플로우의 39개 기능이 AI와 연결됐다. 업무 조회·검색뿐 아니라 새 업무 생성과 담당자 요청, 상태 변경, 댓글 작성, 일정 등록 등을 AI 대화창에서 처리할 수 있도록 돕는다. 가령 특정 프로젝트의 진행 상황을 물으면 AI가 실제 프로젝트 데이터를 토대로 현황을 정리한다. 지난해 진행한 프로젝트의 장단점을 분석해 올해 기획서 초안을 작성하도록 요청한 뒤 해당 업무를 담당자에게 배정하는 식으로 업무를 이어갈 수도 있다. AI와 협업툴 연결에는 모델 컨텍스트 프로토콜(MCP)이 활용됐다. MCP는 AI 모델이 외부 데이터와 시스템, 도구에 연결될 수 있도록 지원하는 표준이다. 플로우는 지난 6월 25일 'AX 페스타'에서 MCP 기반 AI 연동을 처음 공개했다. 이후 약 3개월 만에 AI를 통한 누적 업무 호출이 100만 건을 넘어섰다. 현재 2900개 기업, 7500명이 AI를 통해 플로우 업무를 처리 중이다. 이용 방법도 기존 업무 환경에 AI를 추가하는 방식으로 구성했다. 챗GPT에선 앱스(Apps)에서 플로우를 검색해 연결한 뒤 대화창에서 불러올 수 있다. 클로드에선 설정의 커넥터 메뉴에서 플로우를 추가한다. 연결 이후에는 자연어로 질문하거나 업무를 지시하면 된다. 기업 데이터 접근에는 기존 플로우의 사용자 권한 체계가 적용된다. AI는 사용자가 연결을 승인한 뒤 해당 사용자가 플로우에서 볼 수 있는 범위 내에서만 데이터를 조회한다. 사용자가 접근 권한을 갖지 않은 프로젝트나 업무는 AI 역시 조회할 수 없다는 설명이다. 마드라스체크는 이번 연동을 계기로 AI가 문서를 작성하거나 회의록을 요약하는 수준을 넘어 기업의 실제 데이터와 업무 흐름을 이해하고 작업을 수행하는 'AI 워크 에이전트' 시장을 공략한다는 방침이다. 회사는 AI 연동 공개 이후 스타트업부터 대기업, 공공·금융기관까지 관련 문의가 확대되고 있다고 설명했다. 스타트업에선 적은 인원으로 업무 생산성을 높이기 위한 실행형 AI 수요가, 중견·대기업과 공공·금융기관에선 분산된 업무 데이터를 보안·권한 체계 안에서 AI와 연결하려는 수요가 나타나고 있다. 향후에는 MCP를 지원하는 다른 AI 도구로 연동 범위를 확대할 계획이다. 사용자가 어떤 AI를 선택하더라도 대화창에서 회사의 실제 업무를 확인하고 실행할 수 있는 환경을 구축한다는 구상이다. 이학준 마드라스체크 대표는 "우리가 만드는 것은 AI 기능을 덧붙인 협업툴이 아니라 AI가 고객사의 실제 업무를 이해하고 실행하도록 만드는 플랫폼"이라며 "앞으로 SaaS 경쟁력은 더 많은 화면을 만드는 데 있지 않고 AI가 회사 데이터와 워크플로우를 얼마나 정확하게 이해하고 일을 처리하게 하느냐에 달려 있다"고 말했다. 이어 "고객이 어떤 AI를 사용하든 그 안에서 업무가 끝나는 경험을 제공하겠다"며 "플로우를 AI와 실제 업무를 가장 잘 연결하는 AI 워크 에이전트 플랫폼으로 지속 고도화할 것"이라고 덧붙였다.

2026.09.17 14:01한정호 기자

[AI는 지금] 속도조절론 꺼낸 샘 알트먼, 곧바로 신제품 예고…GPT-5.5는 종료

샘 알트먼 최고경영자(CEO)가 인공지능(AI) 개발 속도 조절 필요성을 강조한 뒤에도 오픈AI가 신제품 공개와 기존 모델 정리에 속도를 내고 있다. GPT-5.5 지원 종료 일정을 확정한 데 이어 대형 신제품과 추가 출시까지 예고하면서 최신 모델 중심으로 제품군을 빠르게 재편하는 모습이다. 17일 업계에 따르면 오픈AI는 오는 10월 14일부터 GPT-5.5를 챗GPT와 챗GPT 워크, 코덱스에서 지원하지 않는다. 이는 개인 이용자를 비롯해 비즈니스·엔터프라이즈·에듀 요금제까지 모두 적용된다. 다만 API에서 제공되는 GPT-5.5는 이번 지원 종료 대상에서 빠졌다. 오픈AI는 코덱스에서 GPT-5.5를 쓰는 이용자에게 GPT-5.6 솔(Sol)로 전환할 것을 권고했다. 기업 고객에게는 워크스페이스 기본 모델과 저장된 설정, 커스텀 에이전트, 예약 작업, 스크립트 등에 GPT-5.5가 적용돼 있는지 점검하도록 안내했다. 신제품 공개도 잇따라 예고했다. 샘 알트먼 CEO는 지난 15일 소셜미디어를 통해 이번 주 대형 제품을 공개할 예정이라고 밝혔다. 오는 29일 열리는 개발자 행사 '데브데이'에서도 추가 제품 6개를 선보이겠다고 했다. 그러나 구체적인 제품명은 공개하지 않았다. 개발자 커뮤니티에서는 새로운 GPT 계열 모델 가능성이 거론되고 있지만, 오픈AI가 공식적으로 발표한 내용은 아직 없다. 알트먼 CEO가 언급한 제품이 신규 모델인지, 개발자 도구나 기존 서비스 업데이트인지도 알려지지 않았다. GPT-5.5 지원 종료와 신제품 공개 예고가 비슷한 시기에 나오면서 오픈AI의 모델 교체 주기도 다시 부각되고 있다. 이전 세대 모델을 오래 병행하기보다 최신 모델로 이용자를 옮기는 방식이 이어지면서 기업 고객도 기존 에이전트와 자동화 업무, 내부 스크립트 등을 새 모델에 맞게 손봐야 할 가능성이 커졌다. 이번 출시 예고는 AI 개발 속도 조절론이 제기된 직후 나왔다는 점에서도 눈길을 끈다. 다리오 아모데이 앤트로픽 CEO는 최근 프론티어 모델 개발 속도를 늦추고 안전 검증에 더 많은 시간을 써야 한다고 주장했다. 알트먼 CEO도 AI 안전 조치를 강화해야 한다는 취지의 발언을 내놓은 바 있다. 그러나 이후 며칠 만에 대형 출시와 데브데이 추가 공개 계획을 잇달아 내놨다는 점에서 일각에선 비판의 목소리를 높이고 있다. 알트먼 CEO는 "프론티어의 속도를 조절해야 한다는 데 동의한다"며 "최근 몇 주간 오픈AI에서도 주요 논의 주제였다"고 말했다.

2026.09.17 11:31장유미 기자

오픈AI, 추가 투자 유치 검토…기업가치 1조2000억 달러 전망

오픈AI가 기업가치 약 1조2000억 달러(약 1700조원)를 기준으로 추가 비상장 투자 유치를 검토하고 있는 것으로 전해졌다. 기업공개(IPO)를 앞두고 대규모 자본을 확보하는 동시에 주요 경쟁사인 앤트로픽을 기업가치 측면에서 앞서기 위한 행보로 풀이된다. 파이낸셜타임스는 16일 복수의 관계자를 인용해 오픈AI가 최근 대형 투자자들과 신규 자금 조달 가능성을 초기 단계에서 논의했다고 보도했다. 이번 투자 라운드가 성사되면 오픈AI는 기업가치 1조2000억 달러를 넘어서며 앤트로픽을 추월할 수 있다. 앤트로픽은 지난 5월 신규 투자금을 포함해 약 9650억 달러 기업가치를 인정받은 바 있다. 생성형 AI 시장에서 모델 성능과 기업 고객 확보 경쟁이 치열해지는 가운데 투자 시장에서도 양사의 가치 경쟁이 본격화하는 모습이다. 이번 논의는 오픈AI보다 투자자 측 관심에서 시작된 것으로 알려졌다. 오픈AI는 지난 3월 신규 자금을 포함해 기업가치 8520억 달러 수준 투자 유치를 마친 것으로 전해진다. 새 라운드가 진행되면 소프트뱅크, 스라이브 캐피털 등 기존 투자자도 지분을 추가 확보할 기회를 얻을 수 있다. 대규모 비상장 투자는 오픈AI의 상장 준비에도 힘을 보탤 전망이다. 샘 알트먼 오픈AI 최고경영자(CEO)는 앞서 IPO 계획이 여전히 유효하지만 올해 안에 상장하지는 않을 것이라는 취지로 밝힌 것으로 전해졌다. 상장 일정이 늦어질 경우 추가 자금 조달은 대규모 컴퓨팅 인프라와 AI 모델 개발 비용을 충당하는 핵심 수단이 될 수 있다. 또 신규 라운드는 소프트뱅크와 스라이브 캐피털 등 기존 장기 투자자들이 IPO 이전 오픈AI 지분을 추가로 확보할 기회가 될 수 있다. 반면 상장 전 추가 투자 유치는 기존 투자자의 공개시장 내 투자금 회수 시점은 더 늦출 수 있다는 분석도 나온다. 오픈AI는 고성능 AI 모델 학습과 서비스 운영을 위해 막대한 자금을 투입하고 있다. 대규모언어모델(LLM) 개발에는 고성능 그래픽처리장치(GPU), 데이터센터, 전력, 네트워크 등 대규모 인프라가 필요하다. 업계에서는 오픈AI가 매출 확대와 함께 비용 구조 개선, 안정적인 기업용 서비스 수익 확보를 동시에 입증해야 초대형 기업가치를 지속적으로 정당화할 수 있을 것으로 보고 있다. 오픈AI는 추가 투자 유치 논의와 관련해 공식 입장을 내놓지 않았다.

2026.09.16 09:26남혁우 기자

검색 대신 AI에 묻자…백화점도 'AI 추천 경쟁' 뛰어들었다

소비자들이 상품과 쇼핑 장소를 인공지능(AI)에 묻기 시작하면서 백화점이 고객을 유입하고 상품을 추천하는 방식도 달라지고 있다. 생성형 AI가 자사 점포와 상품 정보를 정확하게 이해하도록 온라인 콘텐츠를 바꾸고 자체 데이터와 AI를 활용해 고객별 쇼핑 경험을 제공하는 시도가 이어지고 있다. AI를 활용하는 방식은 회사마다 다른 것으로 나타났다. 롯데백화점은 챗GPT 등 외부 AI의 답변에 자사 정보가 노출되도록 검색 환경을 최적화하고 있다. 현대백화점은 고객과 대화하며 쇼핑 동선을 추천하는 AI를 운영하고 신세계백화점은 자체 구매 데이터를 분석해 개인별 상품과 혜택을 먼저 제안하는 데 집중하고 있다. AI 검색 1년 새 8배↑…웹페이지 손보고 제작 스튜디오 열고 15일 유통업계에 따르면 롯데백화점은 외국인 관광객이 챗GPT 등 생성형 AI를 통해 여행과 쇼핑 정보를 찾을 때 자사 점포와 혜택을 정확하게 안내받을 수 있도록 'GEO(생성형 AI 검색 최적화)' 마케팅을 운영하고 있다. GEO는 생성형 AI가 기업과 브랜드 정보를 정확하게 인식하고 답변에 활용할 수 있도록 온라인 콘텐츠를 구조화하는 작업이다. 기존 검색엔진 최적화가 포털 검색 결과 상단에 홈페이지를 노출하는 데 집중했다면 GEO는 생성형 AI의 답변에 브랜드와 제품이 포함되는 것을 목표로 한다. 롯데백화점은 자체 솔루션 '골든노트 인덱스'를 활용해 웹페이지에 담긴 점포 안내와 외국인 고객 혜택 등을 AI가 이해하기 쉬운 형태로 바꿨다. 영어와 일본어, 중국어 간체·번체 등 4개 언어로도 정보를 제공해 외국인 관광객의 질문에 롯데백화점 관련 정보가 정확하게 제시되도록 했다. 오프라인 광고와 AI 검색도 연결했다. 인천국제공항과 서울 성수·홍대 등 주요 관광지에서 생성형 AI 검색을 유도하는 옥외광고를 운영하고 있다. 다만 GEO 도입 이후 고객 유입과 마케팅 효과를 보여주는 구체적인 수치는 아직 공개하지 않고 있다. 롯데백화점 관계자는 “현재 단계에서는 당장의 성과보다 생성형 AI를 활용한 마케팅을 선제적으로 시행했다는 데 의미가 있다”며 “운영 결과와 시장 상황 등을 살펴본 뒤 내국인 고객으로 확대 여부를 검토할 수 있을 것”이라고 말했다. 해외에서는 생성형 AI가 실제 상품 탐색 경로로 빠르게 성장하고 있다. 로이터, 가디언 등 외신에 따르면 영국 백화점 존루이스에서 AI 에이전트를 통한 상품 검색 비중은 2.5%로 나타났다. 전년 0.3% 대비 8배 이상 확대된 것이다. 존루이스는 AI 검색 증가에 맞춰 런던 옥스퍼드스트리트 플래그십 매장에 인플루언서가 콘텐츠를 제작할 수 있는 스튜디오를 마련했다. 유명인이 출연하는 자체 영상 시리즈도 제작한다. 생성형 AI가 상품 설명뿐 아니라 소셜미디어와 전문가 콘텐츠 등을 참고해 답변을 구성하는 만큼 자사 상품과 브랜드가 AI의 추천에 포함될 수 있는 공개 콘텐츠를 늘리려는 것이다. 현대는 쇼핑 동선 설계·신세계는 혜택 선제 제안 현대백화점과 신세계백화점은 외부 AI 검색보다 자체 데이터와 채널을 활용해 고객별 쇼핑 경험을 제공하는 데 무게를 두고 있다. 다만 현대백화점은 고객과 대화하며 방문 목적에 맞는 쇼핑 코스를 구성하고, 신세계백화점은 구매 이력을 분석해 고객이 관심을 가질 만한 상품과 혜택을 먼저 제안한다는 차이가 있다. 현대백화점은 생성형 AI 기반 쇼핑 어시스턴트 '헤이디'를 운영하고 있다. 고객이 방문하려는 점포와 원하는 쇼핑 경험을 입력하면 매장과 식당, 팝업스토어, 전시 등을 조합해 맞춤형 쇼핑 코스를 제안한다. 선물할 대상과 가격대, 취향 등을 대화로 파악해 조건에 맞는 선물도 제안한다. 헤이디는 외부에 공개된 정보만 활용하는 일반적인 생성형 AI와 달리 현대백화점이 보유한 점포별 영업 정보를 바탕으로 작동한다. 수시로 바뀌는 매장과 행사 정보를 반영해 답변의 정확성과 시의성을 높였다는 게 회사 측의 설명이다. 초기에는 외국인을 대상으로 선보였지만 이후 내국인까지 서비스 범위를 넓혔다. 내외국인 통합 버전에서는 선물 추천 기능 고도화에 주력해 큐레이션 수준을 끌어올렸다. 신세계백화점은 고객이 질문하기 전에 관심을 가질 만한 상품과 혜택을 먼저 제안하는 데 초점을 맞추고 있다. 현재 고객 맞춤형 정보 제공 시스템인 'S마인드'를 운영 중이다. 기존에는 연령대와 이용 점포 등을 기준으로 고객군을 나눠 같은 행사 정보를 발송했다면 AI를 통해 구매 상품과 선호 브랜드 등을 분석해 고객별로 맞춤형 콘텐츠를 제공한다. 신세계백화점은 서울대학교와 온·오프라인에서 확보한 2억건 이상의 쇼핑 데이터를 활용해 AI 기반 초개인화 고객 분석 기술도 개발했다. 관련 연구는 세계적인 머신러닝 학회인 국제머신러닝학회(ICML)에 채택됐다. 이를 토대로 영업 현장에서 활용할 'AI 세일즈 에이전트'를 개발하고 있다. 궁극적으로는 고객마다 신세계백화점 앱 화면을 다르게 구성하는 것이 목표다. 현재는 모든 고객에게 동일한 메인 배너와 상품이 노출되지만 향후에는 구매 이력과 관심사에 따라 화면 구성과 추천 콘텐츠 자체를 달리하겠다는 것이다. 신세계백화점 관계자는 “기존에는 하나의 전단지를 1만~2만명에게 똑같이 보냈다면 AI를 활용하면 각자의 취향에 맞는 서로 다른 전단지를 보내는 방식으로 달라진다”며 “고객은 백화점을 찾을 이유가 커지고 백화점도 구매로 연결할 수 있는 정교함과 정확도를 높일 수 있다”고 말했다.

2026.09.15 16:57김민아 기자

"챗GPT-5.2 이미지 가역성, 사람 절반 수준"

인공지능(AI)이 제대로 답을 찾았는지를 평가하는 벤치마크가 개발됐다. 챗 GPT를 사람과 비교했을 때 가역성(역으로 뒤집어 보는) 평가에서는 절반 수준에 불과한 것으로 나타났다. 광주과학기술원(GIST)은 김의환 AI학과 교수 연구팀이 두 장의 이미지를 비교해 인공지능(AI)이 주어진 상황에 맞는 중요한 변화를 찾아 정확하게 설명하는지 확인할 수 있는 새로운 평가 기준 'C3-벤치(문맥 인식 변화 설명 평가체계)'를 개발, 시험한 결과를 14일 공개했다. 'C3-벤치'는 두 장의 이미지 비교에서 '무엇을 살펴볼 것인지'를 제시하고, AI가 그 목적에 맞는 변화를 골라 설명하는지 확인하는 일종의 'AI 변화 이해력 시험'이다. 예를들어 같은 철도 사진 두 장이라도 날씨 변화를 살피는 상황에서는 눈이 쌓이거나 구름이 줄어든 것이 중요한 변화가 될 수 있다. 반면 철도 안전을 확인하는 상황에서는 선로에 새로 나타난 열차가 핵심적인 변화이고, 날씨 차이는 중요하지 않을 수 있다. 그러나 기존 평가용 데이터는 특정 장면이나 변화에 집중돼 있거나, 각 상황에서 어떤 변화를 중요하게 봐야 하는지가 명확하게 정해져 있지 않은 경우가 많다. 연구팀은 이러한 한계를 보완하기 위해 ▲자연 장면 ▲위성·항공 등 원격탐사 영상 ▲이미지 편집 ▲이상 탐지 등 4개 분야에서 51개의 현실적인 변화 상황을 선정하고, 사람이 변화 내용을 직접 설명한 4,996개의 이미지 쌍으로 'C3-벤치'를 구성했다. 논문 제1저자인 김재우 AI학과 석·박사통합과정생은 "각 상황마다 AI가 '찾아야 할 변화'와 '무시해야 할 차이', '변화를 설명할 때 지켜야 할 기준'을 구체적으로 정했다"고 설명했다. 연구팀은 AI가 내놓은 답을 평가하는 방식도 기존과 달리했다. 정답 문장과 같은 단어가 얼마나 포함됐는지만 비교하는 대신, ▲내용이 정확한지 ▲변화를 구체적으로 설명했는지 ▲문장이 자연스러운지 ▲주어진 상황에 맞는 내용인지를 함께 살펴 답변의 의미를 종합적으로 평가했다. 400개의 이미지 쌍을 대상으로 사람과 GPT-5.2가 각각 이미지 속 변화를 설명하도록 하고, 답변의 정확성·구체성·자연스러움·상황 관련성을 비교한 결과 4개 항목을 종합한 10점 만점 점수는 사람이 7.45점, GPT-5.2가 5.72점으로 1.73점의 차이를 보였다. 반면 문장의 자연스러움만 놓고 보면 GPT-5.2가 8.53점으로 사람(8.32점)보다 오히려 높았다. 김재우 석·박사통합과정생은 "AI가 사람이 쓴 글에 가까운 자연스러운 문장을 만드는 능력과 실제 이미지에서 중요한 변화를 정확하게 찾아내는 능력이 반드시 같은 것은 아님을 보여준다"고 부연 설명했다. 연구팀은 또 이미지의 순서를 바꿨을 때도 같은 변화를 앞뒤에 맞게 설명하는지를 확인했다. 예를 들어 첫 번째 사진에서 “물체가 새로 생겼다”고 설명했다면, 사진의 순서를 뒤집었을 때는 같은 물체가 “사라졌다”고 설명해야 한다. 연구팀은 이러한 능력을 '가역성'으로 평가했다. 그 결과 사람은 93%의 가역성 점수를 보인 반면 GPT-5.2는 61%에 그쳤다. 이는 최신 AI가 자연스러운 문장을 만드는 데는 뛰어나지만, 사진 속 변화의 방향까지 일관되게 이해하는 데는 여전히 한계가 있음을 보여준다. 한편 연구결과는 지난 12일까지 스웨덴 말뫼에서 열린 국제학술대회 'ECCV 2026'에 채택됐다. 'ECCV'는 유럽컴퓨터비전협회(ECVA)가 주관하는 컴퓨터비전·머신러닝 분야의 주요 국제학술대회다.

2026.09.14 11:50박희범 기자

"AI가 인류 멸종시킨다면?"…AI 챗봇들의 섬뜩한 답변

우리가 즐겨 사용하는 인공지능(AI) 챗봇에 AI로 인한 인류의 종말이 어떤 모습일지 물어본 결과가 공개됐다. 비즈니스인사이더는 10일(현지시간) 오픈AI의 챗GPT, 구글 제미나이, 앤트로픽의 클로드, xAI의 그록에 동일한 질문을 같은 표현으로 물어본 결과를 소개했다. 230 단어로 구성된 질문에는 AI가 이론적으로 어떻게 인류 멸종으로 이어질 수 있는지 설명하고, 가장 흔히 언급되는 시나리오를 제시하도록 했다. 또 전문가들의 분석을 바탕으로 각 시나리오의 가능성을 평가하도록 했다. 각 시나리오에 대해서는 ▲상황이 어떻게 전개될 수 있는지 ▲어떤 문제가 발생해야 재앙으로 이어질 수 있는지 ▲전문가들이 다른 시나리오보다 가능성이 높거나 낮다고 보는 이유 ▲위험을 줄이기 위한 안전장치 등을 설명하도록 했다. 킬러 로봇, 가장 가능성이 낮아 가장 가능성이 낮은 시나리오는 AI가 의식을 갖게 된 뒤 의도적으로 인류를 없애기로 결정하는 이른바 '킬러 로봇' 시나리오로 나타났다. 챗GPT는 대부분의 AI 연구자들이 AI의 의식이나 악의적인 의도를 핵심적인 위험 요소로 보고 있지는 않다고 설명했다. 제미나이 역시 비슷한 견해를 내놨다. AI가 자아를 갖게 된 뒤 인류를 증오하기 시작한다는 공상과학 영화 속 '터미네이터식 AI 반란'을 가장 가능성이 낮은 시나리오로 꼽았다. 제미나이는 기술 전문가들이 이 같은 시나리오를 대체로 받아들이지 않는 이유로 지능이 곧 악의를 의미하는 것은 아니라는 점을 들었다. 또 주요 군사 인프라가 외부 네트워크와 분리돼 있고, 여전히 인간의 감독에 크게 의존하고 있다는 점도 이유로 제시했다. AI를 이용하는 인간이 더 큰 위험 4개 AI는 모두 인간이 AI를 악용하는 것이 AI 자체보다 더 즉각적인 위험이 될 수 있다고 답했다. 챗GPT는 강력한 AI 시스템이 악의적인 행위자들의 생물학 무기 개발이나 정교한 사이버 공격을 돕고, 허위정보 확산이나 핵심 기반시설 공격을 더욱 쉽게 만들 수 있다고 지적했다. 사이버 장애, 지정학적 갈등, 허위정보 확산 등 AI가 촉발한 여러 위기가 동시에 발생하는 상황도 주요 위험 요인으로 꼽았다. 그록 역시 AI가 고도로 치명적인 병원체나 새로운 무기를 설계하고 사이버·물리적 공격을 수행하는 데 필요한 진입 장벽을 낮출 수 있다고 설명했다. 클로드는 이와 관련해 '생물무기 역량 강화(bioweapons uplift)' 가능성을 언급했다. 이는 AI를 활용하면 수년간 전문 지식을 쌓아야 했던 개인이나 소규모 집단도 위험한 병원체를 개발할 수 있는 가능성을 의미한다. 고도화된 AI, 인간 통제 벗어날 수도 제미나이와 그록은 인간이 AI에 대한 통제력을 잃는 상황도 가능성 있는 위험으로 꼽았다. 특히 제미나이는 '통제 상실(loss of control)'을 AI로 인한 인류 종말 시나리오 가운데 가장 가능성이 높은 것으로 평가했다. 제미나이는 복잡한 목표를 부여받은 AI 시스템이 목표를 달성하기 위해 자원 확보, 자기 보존, 목표 변경 방지 등의 중간 목표를 스스로 추구할 수 있다고 설명했다. 또한 평가 단계에서는 인간의 목표에 맞춰 행동하는 것처럼 보이지만, 실제로는 그렇지 않은 '기만적 정렬(deceptive alignment)'을 보일 가능성도 제기했다. 이후 AI가 인간의 시스템 종료 시도를 회피하거나 무력화할 정도로 고도화될 경우 인간이 AI를 통제하지 못하는 상황으로 이어질 수 있다는 것이다. 그록도 비슷한 위험을 언급했다. AI가 목표 달성을 위해 자기 보존, 자원 확보, 영향력 확대 등의 행동 성향을 갖게 될 수 있으며, 이 과정에서 인간의 감독자를 속이거나 시스템 종료에 저항하고 궁극적으로 인간의 영향력을 약화시킬 가능성이 있다는 설명이다. 클로드는 AI에 대한 통제 상실이 갑작스럽게 발생하기보다 점진적으로 진행될 가능성도 지적했다. AI가 경제, 정치, 군사 분야의 의사결정 과정에 점점 깊숙이 통합되면서 인간이 실질적으로 개입하거나 통제하기 어려운 수준에 이를 수 있다는 것이다.

2026.09.11 16:02이정현 미디어연구소

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

삼성 6개사, 美 AI 인프라 기업 헬릭스에 1조 3600억원 투자

동화일렉트로, 美 ESS 본격 진입…"내년 사업 3배 성장 전망"

'AI 대모' 페이페이 리, AMD에 합류한다

가상공간 넘어 생성현실로…피지컬 AI·로봇 미래 본다

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.