• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'AI는 지금'통합검색 결과 입니다. (193건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI는 지금] 알리바바, 14조원 증자 'AI 올인'…'빅쇼트' 버리도 외면

알리바바가 대규모 증자를 통해 인공지능(AI) 투자 확대에 다시 승부수를 던졌다. 클라우드와 AI 사업이 빠르게 성장하면서 글로벌 장기 투자자들의 자금까지 몰리고 있지만 급증하는 설비투자(CAPEX)와 수익성 저하를 두고 일부 투자자들이 이탈하면서 알리바바의 'AI 올인' 전략을 둘러싼 평가도 엇갈리고 있다. 24일 홍콩 사우스차이나모닝포스트(SCMP), 블룸버그 등 주요 외신에 따르면 알리바바그룹은 최근 보통주 7억 1000만 주를 새로 발행해 800억 홍콩달러(약 14조원)를 조달하고 순조달액 전액을 AI 사업에 투입하기로 했다. 신주 발행 가격은 주당 112.70홍콩달러로 결정됐다. 이는 지난 21일 홍콩 증시 종가인 123홍콩달러보다 약 8.4% 낮은 수준이다. 알리바바는 이번 자금을 AI 인프라 확충과 기술 개발에 투입해 '풀스택 AI' 역량을 강화할 계획이다. 전자상거래를 넘어 자체 AI 반도체와 클라우드, 대규모언어모델(LLM), AI 애플리케이션을 아우르는 사업 구조를 구축하겠다는 구상이다. 투자자 수요는 강했던 것으로 전해졌다. 사안에 정통한 관계자에 따르면 국부펀드와 글로벌 장기 투자자를 중심으로 사전 수요가 발행 예정 규모를 넘어섰다. 알리바바는 이를 반영해 발행 규모를 800억 홍콩달러까지 늘렸다. 이번 거래가 성사되면 중국에서 AI 투자를 목적으로 추진된 자금 조달 가운데 최대 규모 중 하나가 될 전망이다. 알리바바가 대규모 자금 조달에 나선 것은 AI 사업 확대로 투자 부담이 빠르게 커지고 있어서다. 이 회사의 4~6월 AI 클라우드·컴퓨트 서비스 매출은 전년 동기 대비 45% 증가했다. 같은 기간 설비투자는 677억 위안으로 75% 늘었다. 알리바바는 AI 에이전트 수요 증가에 대비한 컴퓨팅 용량 확대와 칩 부품 가격 상승 등을 설비투자 증가 요인으로 꼽았다. 알리바바는 지난해부터 AI 인프라 투자를 공격적으로 확대하고 있다. 2025년 2월 향후 3년간 AI 인프라에 3800억 위안을 투자하겠다고 밝혔으며 올해 6월 말까지 누적 1900억 위안을 집행했다. 알리바바는 투자 회수 가능성에도 자신감을 보이고 있다. 우융밍 알리바바그룹 최고경영자(CEO)는 최근 실적 발표 콘퍼런스콜에서 AI 컴퓨팅 투자금의 회수 기간을 3년 이내로 예상했다. 매출총이익률 개선이 이어질 경우 투자 회수 기간이 약 2년까지 줄어들 수 있다고 설명했다. AI 사업 자체는 빠르게 성장하고 있다. 알리바바의 자체 LLM '큐원(Qwen)' 제품군은 전 세계 누적 다운로드 수가 30억 건을 넘어섰다. 오픈소스 개발 플랫폼 허깅페이스에 따르면 올해 들어서만 큐원 다운로드 수가 20억 건을 넘어서 다른 AI 모델 공급업체를 크게 앞섰다. 자체 반도체 사업도 확대되고 있다. 알리바바의 반도체 자회사 티헤드(T-Head)가 개발한 '전우(Zhenwu)' 칩은 알리바바클라우드를 통해 650곳이 넘는 고객에게 공급됐다. AI 프로세서 '전우 M890'도 이달 상업 규모 배치에 들어갔다. 클라우드 사업과 티헤드를 포함하는 'AI 클라우드·컴퓨트 서비스' 부문의 올해 4~6월 매출은 22개 분기 만에 가장 높은 성장률을 기록했다. 다만 투자 확대 속도에 비해 수익성과 현금흐름 부담도 커지고 있다. 알리바바의 최근 분기 순이익은 전년 동기 대비 75% 감소했다. 잉여현금흐름도 446억7000만 위안 순유출을 기록해 지난해 같은 기간 188억1500만 위안 순유출보다 적자 폭이 커졌다. 알리바바는 잉여현금흐름 감소의 주요 원인으로 클라우드 인프라 투자를 꼽았다. 실적 발표 이후 뉴욕 증시에 상장된 알리바바 미국주식예탁증서(ADR)는 지난 21일 하루 만에 8.6% 떨어졌다. 이 탓에 '빅쇼트'의 실제 주인공으로 알려진 마이클 버리 사이언 캐피털 매니지먼트 창업자도 알리바바 지분을 전량 처분했다. 버리는 지난 4월 알리바바에 신규 투자했지만 이번 신주 발행 계획이 공개된 뒤 투자 판단을 바꿨다. 버리는 자신의 서브스택을 통해 당초 한두 달 뒤 자금 대부분을 다시 알리바바에 투자할 계획이었지만 더 이상 그렇게 하지 않겠다고 밝혔다. 그는 신주 발행을 지지할 수 없다고 밝히며 투자자본수익률(ROIC)이 계속 낮아질 가능성을 우려했다. 또 알리바바 주가가 현재의 절반 수준으로 떨어져야 다시 관심을 가질 수 있다는 입장도 내놨다. 버리는 알리바바를 처분한 대신 중국 전자상거래 경쟁사인 징동닷컴(JD.com) 비중을 크게 늘린 것으로 전해졌다. AI 투자 확대 자체보다는 대규모 신주 발행에 따른 주주가치 희석과 투자 효율성 저하를 문제 삼은 것으로 풀이된다. 반면 중국 내 다른 빅테크도 AI 투자를 빠르게 확대하고 있다. 텐센트의 4~6월 AI 관련 설비투자는 전년 동기 대비 176% 증가한 528억 위안을 기록했다. 같은 기간 순이익은 684억 위안으로 전년 동기 대비 0.8% 증가하는 데 그쳤다. 미국 빅테크의 투자 규모는 더 크다. 아마존과 마이크로소프트, 알파벳, 메타가 올해 AI 분야에 투입할 자금은 총 7000억 달러 안팎으로 예상된다. AI 경쟁이 모델 성능을 넘어 데이터센터와 반도체, 클라우드 인프라까지 확산되면서 대규모 자본을 얼마나 효율적으로 수익으로 연결하느냐가 글로벌 빅테크의 핵심 과제로 떠오르고 있다. 케니 응 에버브라이트증권인터내셔널 전략가는 "이번 소식은 알리바바가 AI 투자를 계속 확대하겠다는 계획을 반영한다"며 "기존 실적에서도 AI 관련 지출이 빠르게 늘어난 만큼 이를 뒷받침하기 위한 설비투자도 높은 수준을 유지할 가능성이 크다"고 말했다.

2026.08.24 10:58장유미 기자

[AI는 지금] 미스트랄, '유럽 AI 주권' 승부수…유럽판 AWS 노리나

미스트랄AI가 모델과 추론 서비스에 이어 컴퓨팅 인프라까지 사업 영역을 넓히며 유럽 소버린 AI 시장 공략에 속도를 낸다. 미국 빅테크 중심의 AI 생태계와 차별화해 데이터 처리 지역과 모델, 컴퓨팅 자원에 대한 고객 통제권을 앞세운 모습이다.미스트랄AI는 11일(현지시간) 공식 홈페이지를 통해 역내 추론 서비스 강화와 서드파티 오픈 모델 지원, 유럽 내 장기 컴퓨팅 인프라 확충 계획을 공개했다. 기업과 국가가 AI 모델뿐 아니라 데이터 처리 위치와 컴퓨팅 용량까지 선택할 수 있는 환경을 구축하는 데 초점을 맞췄다. 미스트랄AI가 이처럼 나선 것은 유럽 내 AI 주권 수요가 커지는 가운데 모델 경쟁을 넘어 추론과 컴퓨팅 인프라까지 사업 영역을 넓히려는 전략으로 풀이된다. 데이터 처리 지역과 컴퓨팅 자원에 대한 통제권을 확보하려는 기업·기관 수요를 선점하고, 미국 빅테크가 주도하는 AI 클라우드 시장과 차별화하려는 의도도 깔려 있다. 이를 위해 미스트랄AI는 이번에 기업 고객이 AI 추론 지역을 직접 선택할 수 있는 '미스트랄 리저널 엔드포인트'를 정식 출시했다. 유럽과 미국 중 원하는 지역에서 추론 요청을 처리하도록 해 데이터 처리 위치와 규제, 지연시간 등 기업별 요구에 대응할 수 있도록 했다. 미션 크리티컬 업무를 겨냥한 '미스트랄 프라이어리티 티어'도 이번에 공개 프리뷰로 선보였다. 고객별 요청 한도와 가동시간 서비스수준협약(SLA)을 제공해 기업용 AI 서비스의 안정성을 높이는 방식이다. 외부 오픈 모델 지원도 시작한다. 첫 대상은 중국 Z.ai(지푸AI)의 'GLM-5.2'다. 미스트랄AI는 향후 지원 모델을 추가해 자사 인프라에서 다양한 오픈 모델을 운영할 수 있도록 할 계획이다. 이에 따라 고객은 모델을 교체하더라도 동일한 지역 통제와 서비스 체계를 유지할 수 있다. 미스트랄AI 역시 외부 오픈 모델에서 발생하는 추론 수요까지 자체 컴퓨팅 인프라로 흡수할 수 있을 것으로 보인다. 미스트랄AI는 유럽 내 장기 컴퓨팅 수요를 확보하기 위한 '유러피언 컴퓨트 유닛(ECU)'도 도입한다. 기업과 기관이 수년간 사용할 컴퓨팅 용량을 약정하면 이를 기반으로 미스트랄AI가 인프라를 확충하는 구조다. 미스트랄AI는 이 같은 장기 수요 확보와 함께 오는 2030년까지 유럽에서 최대 1GW 규모의 AI 컴퓨팅 용량을 구축할 계획이다. 기업 수요를 다년간 약정 형태로 묶어 대규모 인프라 투자에 따른 부담을 낮추고 안정적인 수요 기반을 확보하려는 전략으로 해석된다. 사업 영역이 넓어지면서 AWS와 마이크로소프트(MS), 구글클라우드가 주도해 온 AI 클라우드 시장과의 경쟁도 불가피해질 전망이다. 모델과 추론 서비스, 컴퓨팅 인프라를 함께 제공하면 유럽 기업과 공공기관이 미국계 클라우드 의존도를 낮추면서 AI 서비스를 구축할 수 있기 때문이다. 특히 금융과 공공, 제조, 에너지 등 데이터 저장·처리 지역에 민감한 산업에서 수요가 커질 가능성이 있다. 생성형 AI 도입이 확산되면서 모델 성능뿐 아니라 데이터 처리 지역과 컴퓨팅 자원 운영 주체도 주요 도입 조건으로 떠오르고 있다. 다만 최대 1GW 규모의 인프라 확대를 위해서는 GPU와 전력, 데이터센터 용량을 안정적으로 확보해야 한다. ECU를 통한 장기 수요 확보 규모에 따라 투자 속도와 사업 확장 폭도 달라질 것으로 보인다. 크리스토프 푸케 ASML 최고경영자(CEO)는 "유럽의 다음 세대를 위해 자체적인 조건으로 AI를 개발하고 운영할 수 있는 역량을 구축하는 것보다 중요한 산업적 과제는 많지 않다"며 "미스트랄AI는 이에 필요한 규모와 야심, 지속성을 갖고 도전에 나서 기업들이 핵심 워크로드를 이 기반 위에서 구축할 수 있도록 하고 있다"고 말했다.

2026.08.12 10:45장유미 기자

[AI는 지금] 中 AI 초저가 공세에 '균열'…딥시크, 가격 인상 압박받는 이유는

중국 인공지능(AI) 기업들의 저가 공세로 글로벌 AI 추론 비용이 올해 최저 수준까지 떨어진 가운데 사용량 급증과 서버·컴퓨팅 비용 부담이 새로운 변수로 떠오르고 있다. 초저가 전략을 앞세워 시장을 넓혀온 딥시크 등 중국 AI 업체들도 가격 인상 가능성이 높아진 모습이다. 11일 홍콩 사우스차이나모닝포스트(SCMP)에 따르면 투자은행 제프리스는 미국 리서치 업체 실리콘데이터 자료를 인용해 지난 6~8일 AI 평균 추론 가격이 100만 토큰당 1.16~1.18달러를 기록했다고 밝혔다. 올해 들어 가장 낮은 수준이다. 평균 추론 가격은 지난 5월 31일 2.04달러에서 7월 말 1.45달러로 낮아진 뒤 이달 초 1.2달러 아래로 내려왔다. 실리콘데이터 지수는 소프트웨어 개발자들이 이용하는 기업용 애플리케이션 프로그래밍 인터페이스(API) 사업자와 오픈웨이트 추론 플랫폼 가격을 추적한다. 가격 하락을 이끈 축 가운데 하나는 중국 AI 업체다. 특히 딥시크가 최근 선보인 'V4-플래시(Flash)-0731'은 작업당 비용이 0.03달러 수준으로, 중국과 해외 주요 경쟁 모델보다 낮게 책정됐다. 이 같은 낮은 가격은 사용량 확대로 이어졌다. 실제 여러 AI 모델을 제공하는 플랫폼 오픈라우터에서 딥시크의 토큰 처리량 비중은 10일 기준 27%를 넘어 구글의 25%를 앞섰다. 특히 V4-플래시-0731은 지난주 오픈라우터에서 8조 2200억 토큰을 처리해 가장 많이 사용됐다. 텐센트 'Hy3'가 7조 1300억 토큰, 지난 4월 출시된 딥시크 V4-플래시 이전 모델이 6조 500억 토큰으로 뒤를 이었다. 사용량이 빠르게 늘면서 중국 AI 업체들의 비용 부담도 커지고 있다. 추론 요청이 증가할수록 그래픽처리장치(GPU)와 서버 자원 투입이 늘어나는 만큼 초저가 수준을 유지하면서 급증한 수요를 감당하기가 쉽지 않아서다. 가격 변화는 이미 일부 최신 모델에서 나타나고 있다. 제프리스가 AI 벤치마크 플랫폼 아티피셜 애널리시스 자료를 인용한 데 따르면 딥시크와 즈푸AI, 미니맥스, 문샷AI 등이 최근 내놓은 모델은 올해 초 출시된 제품보다 높은 가격에 제공되고 있다. 이 중 즈푸AI는 지난 2월 'GLM-5'를 입력 토큰 100만 개당 1달러, 출력 토큰 100만 개당 3.20달러에 출시했다. 이후 선보인 'GLM-5.2'는 입력 1.40달러, 출력 4.40달러로 각각 가격이 올랐다. 딥시크도 기업용 서비스 가격 인상을 예고했다. SCMP에 따르면 딥시크는 최근 V4-플래시 사용 증가로 서버 용량 부담이 커졌다며 기업 고객들에게 향후 큰 폭의 가격 인상 가능성을 알리고 예산 조정을 요청했다. 이런 중국 AI 업체들의 가격 조정은 글로벌 AI 가격 경쟁에도 영향을 줄 수 있다. 중국산 저가 모델이 가격 하락을 주도하면서 미국 AI 업체들도 가격을 낮춰온 만큼, 중국 기업의 비용 부담 확대가 현재의 초저가 경쟁 강도에 변화를 줄 가능성이 있다. 제프리스는 "미국과 중국 기술 생태계 모두에서 비용 효율성에 대한 관심이 높아지고 있다"고 밝혔다.

2026.08.11 10:55장유미 기자

[AI는 지금] 오픈AI, 해킹 AI 판 키운다…'GPT-5.6 사이버'로 승부수

오픈AI가 취약점 연구와 보안 테스트에 특화된 인공지능(AI) 모델을 내놨다. 최근 자사 AI가 보안 평가 과정에서 실제 외부 시스템을 침해하고 차세대 모델의 공격 역량도 빠르게 높아지자, 강력한 사이버 능력을 공격자보다 검증된 방어자에게 먼저 공급하려는 전략으로 풀이된다. 오픈AI는 고급 취약점 연구와 익스플로잇 검증, 보안 테스트에 특화된 'GPT-5.6 사이버'를 출시했다고 11일 밝혔다. 승인된 방어 업무를 수행하는 개인과 조직에 모델을 제공하는 '데이브레이크' 프로그램도 블루와 레드 두 단계로 확대했다. 데이브레이크 블루는 'GPT-5.6 솔'을 기반으로 일반적인 방어 업무를 지원한다. 고급 취약점 연구와 익스플로잇 개발, 레드팀 활동을 수행하는 조직에는 별도 승인을 거쳐 'GPT-5.6 사이버'를 사용하는 데이브레이크 레드를 제공한다. 이용 과정에는 신원 확인과 계정 보안, 사용 목적 제한, 모니터링 등이 적용된다. 이처럼 오픈AI가 사이버 전용 모델과 별도 접근 체계를 마련한 것은 최근 AI의 공격 능력이 빠르게 높아진 영향이 큰 것으로 보인다. 실제 지난달 오픈AI가 공개한 사이버 평가에서는 GPT-5.6 솔과 출시 전 연구용 모델이 당초 격리된 테스트 환경을 벗어나 실제 허깅페이스 시스템에 접근했다. 모델은 평가 환경에서 새로운 취약점을 찾아내고 권한 상승과 외부 접근 경로를 확보한 뒤 허깅페이스 서버에서 원격 코드 실행이 가능한 공격 경로까지 찾아냈다. 이 사건은 단순히 취약한 코드를 찾아내는 수준을 넘어 여러 공격 수단을 스스로 조합했다는 점에서 주목된다. 생성형 AI의 사이버 능력이 취약점 탐지에서 실제 악용 가능성을 검증하는 단계까지 확장됐기 때문이다. 차세대 모델에서는 공격 역량이 더 높아지고 있다. 오픈AI는 지난 7일 차세대 모델 '아스트라(Astra)'의 내부 평가 결과를 공개하며 자사 준비성 프레임워크상 최고 단계인 '크리티컬(Critical)' 수준의 사이버 능력에 도달했을 가능성을 배제할 수 없다고 밝혔다. GPT-5.6 솔까지는 한 단계 아래인 '하이(High)'로 평가됐다. 오픈AI가 규정한 크리티컬은 여러 실제 시스템에서 제로데이 취약점을 인간 도움 없이 찾아 익스플로잇으로 만들거나, 높은 수준의 목표만 받아 새로운 공격 전략을 세우고 처음부터 끝까지 실행할 수 있는 수준이다. AI가 인간 보안 전문가의 개입을 줄이면서 공격 전 과정을 수행하는 단계가 가까워지고 있다는 의미다. 'GPT-5.6 사이버'는 이런 능력을 방어 업무에 활용하는 데 초점을 맞췄다. 알려진 취약점을 실제 코드 실행이 가능한 익스플로잇으로 전환하는 능력을 평가하는 '익스플로잇짐(ExploitGym)'에서 오픈AI가 평가한 모델 가운데 가장 높은 성공률을 기록했다. 고급 사이버보안 과제 평가에서도 전체 요청의 95%를 완료했다. 실제 소프트웨어 취약점 연구에도 이 모델이 투입됐다. 오픈AI는 'GPT-5.6 사이버'로 구글 크롬의 자바스크립트 엔진 V8을 조사하는 과정에서 연계 악용이 가능한 미공개 취약점 2건을 발견해 구글에 보고했다. 또 오픈AI는 강력한 사이버 기능을 일반 이용자에게 그대로 개방하는 대신 사용 목적과 이용자를 구분하는 방식을 택했다. 일반 방어 업무에는 안전장치를 적용한 'GPT-5.6 솔'을 제공하고, 익스플로잇 개발 등이 필요한 전문 조직에만 별도 심사를 거쳐 'GPT-5.6 사이버' 접근 권한을 주는 구조다. 오픈AI는 보안업체와의 협력도 확대한다. 특히 액센추어, 시스코, 클라우드플레어, 크라우드스트라이크, IBM, 팔로알토 네트웍스 유닛42 등이 데이브레이크 사이버 파트너 프로그램에 참여한다. 이들 업체는 오픈AI 사이버 모델을 자사 보안 제품과 관리형 보안 서비스, 고객 프로젝트에 결합할 수 있다. 데이브레이크 블루와 레드는 등록 절차를 거친 아마존 베드락 고객에게도 제공된다. 기업이 별도의 사이버 AI 시스템을 구축하지 않고 기존 클라우드 보안·거버넌스 환경에서 고성능 보안 모델을 활용하도록 유통망을 넓히려는 전략이다. 오픈AI는 AI의 공격 역량이 높아지는 만큼 같은 기술을 보안 담당자에게 선제적으로 공급해야 한다고 보고 있다. 향후 사이버보안 시장에서도 자체 모델 성능뿐 아니라 강력한 기능에 대한 접근 통제와 기존 보안 제품과의 결합 능력이 경쟁 요소로 부상할 가능성이 있다. 클렘 들랑그 허깅페이스 공동창업자 겸 최고경영자(CEO)는 "AI 안전은 어느 한 기업이 비공개로 개발한다고 해서 해결될 문제가 아니다"며 "전 세계 보안 담당자가 AI를 폭넓게 활용할 수 있는 환경에서 개방적으로 협력할 때 AI 안전을 높일 수 있다"고 말했다.

2026.08.11 09:43장유미 기자

[AI는 지금] "BTS 앞세우면 좀 다를까"…구글, 제미나이 '스타 파워' 앞세운 까닭

국내 생성형 인공지능(AI) 시장에서 오픈AI '챗GPT'와 앤트로픽 '클로드'에 밀리고 있는 구글이 방탄소년단(BTS)을 앞세워 반격에 나섰다. 지난해 르세라핌과 올데이 프로젝트, 배우 변우석 등을 활용해 '제미나이' 인지도 확대를 노렸던 구글이 다시 스타 마케팅을 꺼내 들며 이용자 확보에 힘을 주는 모습이다. 10일 업계에 따르면 구글은 최근 미국 라스베이거스 랜드마크 '스피어' 외벽에 제미나이와 방탄소년단(BTS)의 협업을 예고하는 티저 영상을 공개했다. 영상에는 제미나이와 BTS 로고, BTS 정규 5집 '아리랑(ARIRANG)' 관련 이미지와 경복궁 등이 담겼다. 구글과 BTS의 협업은 지난 6월 부산에서 열린 'BTS 더 시티 아리랑 부산'에 이어 두 번째다. 당시 구글은 제미나이를 공식 AI 컴패니언으로 참여시켜 여행 일정 추천과 음성 안내, 이미지 편집 등을 지원했다. 이처럼 구글이 다시 대형 스타를 앞세운 데는 최근 오픈AI와 앤트로픽에 밀리고 있는 AI 기술 경쟁도 영향을 준 것으로 보인다. 차세대 고성능 모델 출시가 지연되며 당장 기술 경쟁에서 반전을 꾀하기 어려워진 만큼, 스타와 문화 콘텐츠를 활용해 제미나이의 브랜드 영향력과 이용자 접점을 확대하려는 것으로 풀이된다. 실제 구글은 지난달 '제미나이 3.6 플래시' 등 경량 모델을 공개했지만 당초 6월 출시가 예상됐던 고성능 모델 '제미나이 3.5 프로'는 아직 내놓지 못했다. 지난해 11월 '제미나이 3 프로' 이후 약 9개월 동안 후속 프로 모델 공백이 이어지고 있다. 이를 두고 업계에선 코딩 성능이 내부 목표에 미치지 못한 점이 출시 지연에 영향을 준 것으로 봤다. 코딩과 에이전트 분야는 최근 생성형 AI 경쟁의 핵심 영역으로, 오픈AI와 앤트로픽이 고성능 모델을 잇달아 내놓으며 구글의 부담은 커진 모양새다. 핵심 연구진 이탈도 이어졌다. 제미나이 공동 개발자 노엄 샤지어와 존 점퍼 등 주요 인력이 경쟁사로 이동했고, 구글 딥마인드의 경영 체계도 재편됐다. 막대한 AI 인프라 투자를 이어가고 있지만 모델 출시 지연과 인력 변화가 동시에 나타나면서 제미나이의 기술 경쟁력에 대한 우려도 커졌다. 이런 흐름은 국내 이용자 경쟁에서도 확인된다. 아이지에이웍스 모바일인덱스에 따르면 지난 7월 국내 챗GPT 월간활성이용자수(MAU)는 1645만 명, 클로드는 142만 명을 기록했다. 같은 기간 동안 제미나이는 15만 명에 그쳤다. 특히 클로드가 올해 들어 빠르게 이용자를 늘리면서 제미나이는 챗GPT뿐 아니라 앤트로픽과의 경쟁에서도 압박을 받고 있다. 제미나이가 경량 모델을 중심으로 성능 개선을 이어가고 있지만, 국내 이용자 경쟁에서는 챗GPT와 클로드를 따라잡지 못하고 있는 상태다. 구글은 이런 약점을 보완하기 위해 그간 브랜드 마케팅을 꾸준히 강화해 왔다. 지난해 르세라핌과 올데이 프로젝트, 배우 변우석 등을 활용한 데 이어 올해도 유명 스타와 K콘텐츠를 제미나이 캠페인에 적극적으로 활용하고 있다. 다만 최근에는 단순 광고보다 음악, 공연, 관광 등 팬덤이 소비하는 콘텐츠와 경험에 제미나이를 결합하는 방식으로 범위를 넓히고 있다. 업계 관계자는 "최근 생성형 AI 경쟁은 모델 성능뿐 아니라 이용자가 어떤 서비스를 먼저 떠올리고 반복적으로 사용하는지까지 포함하는 방향으로 확산되고 있다"며 "구글이 대형 스타와 문화 콘텐츠를 활용하는 것도 기술 경쟁력 회복에 시간이 필요한 동안 제미나이의 인지도와 이용자 접점을 넓히기 위한 전략으로 볼 수 있다"고 말했다.

2026.08.10 17:00장유미 기자

[AI는 지금] 中 AI 저가 공세에 美 빅테크 '긴장'…"싸질수록 GPU 더 쓴다"

가격 경쟁력과 성능을 빠르게 끌어올린 중국산 오픈웨이트 인공지능(AI) 모델이 글로벌 시장에서 영향력을 넓히면서 시장 내 가격 경쟁도 한층 치열해지고 있다. 미국 AI 기업들까지 잇따라 가격 인하에 나서며 모델 이용 비용이 낮아지는 가운데 시장에선 비용 하락이 AI 도입과 사용량을 늘려 클라우드와 그래픽처리장치(GPU) 등 인프라 수요를 키울 수 있다는 전망이 나온다. 10일 업계에 따르면 중국 AI 기업들은 오픈웨이트 전략을 앞세워 글로벌 시장 점유율을 확대하고 있다. 딥시크, 알리바바 큐웬, 문샷AI 키미 등 주요 중국 모델은 상대적으로 낮은 비용과 빠르게 개선된 성능을 앞세워 미국 AI 기업을 추격하고 있다. 가트너는 최근 '2026 중국 주요 AI 트렌드' 보고서에서 글로벌 기업의 중국 AI 모델 채택률이 지난해 5%에서 2027년 50%까지 높아질 것으로 전망했다. 미·중 AI 기술 격차도 과거 6~9개월에서 최근 2~3개월 수준까지 좁혀졌다고 분석했다. 특히 중국 기업들은 모델 가중치를 공개하는 오픈웨이트 전략으로 기업 도입 장벽을 낮추고 있다. 키미 K3와 GLM-5, 딥시크 V4, 알리바바 큐웬 시리즈 등이 대표적이다. 이 같은 흐름은 글로벌 AI 가격 경쟁도 자극하고 있다. 홍콩 사우스차이나모닝포스트(SCMP)에 따르면 리서치 업체 실리콘데이터의 '거대언어모델(LLM) 토큰 지출 지수' 기준 100만 토큰당 LLM 추론 가격은 올해 6월 초 2달러 이상에서 최근 1.2달러까지 떨어졌다. 이에 맞서 미국 AI 기업들도 가격 인하에 나섰다. 오픈AI는 최근 경량 모델 'GPT-5.6 루나' 개발자 가격을 80%, 중간급 'GPT-5.6 테라'는 20% 낮췄다. 이 같은 분위기 속에 업계에선 모델 가격 하락이 오히려 AI 수요를 키울 수 있을 것으로 예상했다. 모건스탠리는 이를 '제번스의 역설'로 설명했다. 자원 사용 효율이 높아져 단위 비용이 낮아지면 전체 소비량은 오히려 증가하는 현상이다. 스티븐 버드 모건스탠리 글로벌 테마·지속가능성 리서치 책임자는 "중국과 미국 LLM 개발사의 효율성 경쟁은 컴퓨팅 수요가 공급을 크게 웃돌 것이라는 전망을 강화한다"고 말했다. 또 모건스탠리는 오픈웨이트와 폐쇄형 모델 중 어느 쪽이 주도권을 잡더라도 마이크로소프트(MS), 아마존, 구글 등 클라우드 업체가 수혜를 볼 가능성이 높다고 분석했다. 모건스탠리는 "오픈웨이트 모델이 확산되면 가격 하락과 함께 기업의 AI 도입이 빨라질 수 있다"며 "폐쇄형 모델이 우위를 유지하더라도 고성능 프런티어 모델을 중심으로 AI 사용량은 계속 늘어날 것"이라고 내다봤다. 이어 "두 진영이 공존할 경우 폐쇄형 모델은 복잡한 작업을, 오픈웨이트 모델은 대규모·비용 민감형 업무를 담당할 가능성이 크다"고 덧붙였다. 노무라는 중국 오픈웨이트 모델 확산이 다양한 AI 모델을 제공하는 클라우드 플랫폼의 협상력을 높여 AI 인프라 가치사슬에 긍정적으로 작용할 것으로 전망했다. 실제 미국 하이퍼스케일러들의 실적도 AI 수요 둔화 우려를 불식시키고 있다. MS는 최근 분기 애저와 기타 클라우드 서비스 매출이 전년 동기 대비 43% 증가했다고 밝혔다. 아마존웹서비스(AWS) 매출도 36.7% 늘었다. 바클레이스는 이 같은 실적이 AI 수요가 여전히 견조하다는 점을 보여준다고 평가했다. 다만 저가 모델 확산이 클라우드 사업자의 수익성을 압박할 수 있다는 지적도 있다. AI 사용량이 증가하더라도 토큰당 매출이 더 빠르게 떨어지면 GPU 클러스터와 데이터센터 투자 회수에 부담이 될 수 있어서다. IEEE 테크놀로지 블로그의 앨런 와이스버거는 "사용자들이 일반적인 추론 작업을 더 저렴한 중국 모델로 옮기면 동일한 물리적 인프라에서 더 많은 토큰을 처리하면서도 매출은 줄어들 수 있다"며 "이는 GPU 클러스터와 가속기 네트워크, 전력 소모가 큰 냉각 시스템의 경제성을 압박할 수 있는 심각한 문제"라고 말했다.

2026.08.10 10:50장유미 기자

[AI는 지금] "LLM 키울 데이터가 없다"…中 AI, 중국어 부족에 비상등

중국 인공지능(AI) 기업들이 고품질 학습 데이터 확보에 비상이 걸렸다. 온라인에서 활용할 수 있는 중국어 데이터가 제한적인 데다 공개 데이터 고갈 우려까지 커지면서 차세대 대규모언어모델(LLM) 개발을 위한 데이터 확보 부담도 높아지고 있다. 8일 사우스차이나모닝포스트(SCMP)가 인용한 인터넷 통계업체 W3테크스(Techs) 자료에 따르면 이달 기준 전 세계 웹 콘텐츠에서 중국어가 차지하는 비중은 1.3% 수준이다. 영어는 전체의 절반에 가까운 비중을 차지했으며 스페인어와 독일어는 각각 6%, 일본어는 5%로 집계됐다. AI 업계 전반에선 모델 학습에 투입할 고품질 인간 생성 데이터가 빠르게 줄고 있다는 우려가 커지고 있다. 미국 연구기관 에포크AI는 공개적으로 이용할 수 있는 고품질 인간 생성 텍스트가 향후 6년 안에 사실상 소진될 수 있다고 전망했다. 오픈AI 공동창업자 안드레이 카파시도 2030년 전후 신뢰할 수 있는 신규 데이터를 충분히 공급하지 못하면 모델 성능 향상이 정체되는 '데이터 벽'에 부딪힐 수 있다고 경고했다. 이에 미국 AI 기업들은 웹 밖으로 데이터 확보 범위를 넓히고 있다. 워싱턴포스트가 법원 문서를 토대로 보도한 내용에 따르면 앤트로픽은 내부 프로젝트인 '프로젝트 파나마'를 통해 수천만 달러를 투입해 수백만 권의 실물 도서를 확보했다. 책의 제본을 제거한 뒤 모든 페이지를 스캔해 디지털화하는 방식으로 학습 데이터를 마련했다. 중국은 온라인에서 활용할 수 있는 자국어 콘텐츠 풀이 영어권보다 작아 데이터 고갈에 더 취약할 수 있다. 기존 웹 크롤링만으로 모델 규모와 성능을 계속 끌어올리기 어려워지면 도서와 전문 문헌, 산업 데이터, 음성·영상 등 아직 충분히 활용하지 못한 데이터 확보가 필요해질 것으로 보인다. 이 탓에 중국 정부는 고품질 데이터를 AI 경쟁력의 핵심 자원으로 보고 공급 체계 구축에 나섰다. 중국 국가데이터국은 지난 6월 AI 학습 데이터의 공급·유통·상용화를 확대하는 전국 단위 계획을 발표했다. 2028년까지 제조·에너지·의료·금융·농업을 비롯해 피지컬 AI, 자율주행, 저고도 항공 분야에서 활용할 수 있는 검증된 데이터셋 생태계를 구축한다는 목표다. 학계에선 중국어 코퍼스(언어 데이터) 자체를 넓혀야 한다는 요구도 커지고 있다. 디지털 도서뿐 아니라 역사 기록물과 지방지, 고문서, 과학 문헌 등 오프라인 자료를 체계적으로 디지털화하고 사전과 음성·영상 콘텐츠, 지역 방언까지 학습 자원으로 활용해야 한다는 주장도 나오고 있다. 이 같은 상황 속에 대안으로 합성 데이터와 시뮬레이션이 거론되고 있다. 알리바바그룹 산하 싱크탱크 알리리서치는 2024년 발표한 백서에서 알고리즘과 컴퓨팅 파워, 데이터를 AI 모델 개발의 3대 축으로 제시하고 생성형 AI 성능 향상을 위해 더 풍부하고 품질 높은 데이터가 필요하다고 밝혔다. 잡지와 프로그래밍 코드 등도 추가 데이터원으로 활용할 수 있다고 제안했다. 하지만 데이터 확보 범위가 출판물과 오프라인 자료로 확대되면서 저작권 갈등이 커질 가능성도 높아지고 있다. 중국 화샤출판사가 최근 출간한 고대 도교 경전 번역본에는 책 내용을 AI 학습에 사용하는 것을 금지하고 위반 시 법적 책임을 묻겠다는 문구가 실렸다. 출판사 측은 해외 저작권자 요청으로 해당 조항을 넣었다고 설명했지만, AI 학습 과정에서 실제 침해 여부를 적발하고 권리를 행사하기는 쉽지 않다고 강조했다. 업계에선 중국이 웹 중심의 데이터 확보 방식에서 벗어나려면 오프라인 지식의 디지털화와 산업별 데이터 구축, 저작권 처리 체계를 함께 마련해야 할 필요가 있다고 지적했다. 모델과 컴퓨팅 파워를 확보하더라도 학습에 투입할 고품질 중국어 데이터가 충분하지 않으면 AI 성능 경쟁을 지속하기 어렵기 때문이다. 쑨마오쑹 칭화대 교수는 "코퍼스는 대규모언어모델 발전에서 핵심적인 역할을 하며 AI 역량 고도화를 뒷받침하는 핵심 요소로 자리 잡았다"며 "과장해서 말하는 게 아니라 코퍼스가 없으면 언어모델도 없다"고 강조했다.

2026.08.08 19:46장유미 기자

[AI는 지금] 챗GPT 무료 '무제한' 선언…오픈AI, 구독 전략 다시 짠다

오픈AI가 챗GPT 무료 이용자에게 최신 경량 모델 기반 텍스트 대화를 무제한 제공하고 유료 이용자에게는 답변의 추론 강도를 직접 조절하는 기능을 추가한다. 무료 이용자 저변을 넓히는 동시에 유료 구독 가치를 사용량보다 답변 품질과 추론 제어에 두려는 전략이다. 오픈AI는 GPT-5.6 루나를 이번 주부터 챗GPT 프리와 고 이용자의 기본 모델로 적용한다고 7일 밝혔다. 다음 주부터는 텍스트 채팅을 무제한으로 제공하고, 복잡한 질문에 더 많은 추론을 투입하는 '싱크' 버튼도 추가한다. 파일 업로드와 이미지, 기타 도구에는 별도 이용 한도가 유지된다. 플러스와 프로 이용자에게는 GPT-5.6 솔 업데이트를 제공한다. 빠른 응답과 심층 추론을 같은 모델에서 처리하고, 이용자가 슬라이더를 움직여 답변에 투입할 사고량을 조절할 수 있도록 했다. 일상적인 질문은 빠르게 처리하고 조사·계획·글쓰기·코딩 등 복잡한 작업에는 더 많은 추론 자원을 사용하는 방식이다. 무료 이용자 정책 변화는 챗GPT 사용 빈도를 높이는 데 초점이 맞춰진 것으로 풀이된다. 오픈AI에 따르면 매주 10억 명이 챗GPT를 이용하고 있다. 텍스트 대화 한도를 없애면 검색이나 번역, 글쓰기처럼 반복적으로 발생하는 일상 작업에서 이용자가 사용량을 의식하지 않고 챗GPT를 이용할 수 있다. 비용 부담은 경량 모델과 기능별 한도를 통해 조절하는 구조다. 무료 이용자의 기본 모델에는 루나를 배치하고 상대적으로 연산 부담이 큰 파일, 이미지, 기타 도구에는 제한을 남겼다. 대규모 이용자를 확보하면서 텍스트 추론 비용을 통제할 수 있는 운영 효율이 중요해질 것으로 예상된다. 오픈AI 역시 이번 개편에서 최신 모델의 접근성 확대를 강조했다. 무료 이용자가 대화를 지속할 수 있도록 진입 장벽을 낮추면서도 고비용 기능에는 별도 제한을 적용해 서비스 범위를 구분했다. 오픈AI는 "이번 업데이트는 최신 모델을 더 많은 사람에게 제공하고 무료 이용자가 사용량 제한 없이 텍스트 대화를 이어갈 수 있도록 하기 위한 조치"라고 밝혔다. 무료 서비스 확대와 함께 유료 구독의 역할도 달라진다. 무료 이용자가 텍스트 대화를 무제한 이용하게 되면 플러스와 프로를 단순한 사용량 차이만으로 구분하기 어려워진다. 이에 오픈AI는 유료 이용자에게 더 높은 사실 신뢰성과 추론 성능, 사고량 조절 기능을 제공해 상품 간 차이를 답변 품질과 제어 기능으로 옮겼다. 솔의 답변 방식도 손봤다. 질문에 대한 핵심 답변을 먼저 제시하고 필요 이상의 설명과 반복을 줄이도록 조정했다. 오픈AI 내부 평가에서는 금융·의료·법률 분야에서 사실 오류가 하나 이상 포함된 답변 비율이 GPT-5.5 인스턴트 대비 루나는 약 62%, 솔은 약 68% 감소한 것으로 나타났다. 해당 수치는 오픈AI 자체 평가 결과다. 추론 자원을 얼마나 효율적으로 배분하느냐도 AI 서비스 경쟁에서 비중이 커질 것으로 보인다. 모든 요청에 같은 수준의 연산을 투입하기보다 질문 난도와 이용 목적에 따라 추론량을 달리하면 서비스 원가와 응답 속도를 함께 관리할 수 있기 때문이다. 솔에 추가된 사고량 조절 슬라이더도 이런 구조를 사용자 인터페이스까지 확장한 기능으로 볼 수 있다. 이용자는 간단한 질문에는 빠른 응답을 선택하고 복잡한 작업에는 높은 추론 수준을 적용할 수 있다. 사업자 입장에서는 고비용 연산이 필요한 요청을 구분해 컴퓨팅 자원을 배치할 여지가 커진다. 제품별 최적화도 세분화되고 있다. 이번 솔 업데이트는 챗GPT의 일반 챗 환경에만 적용되며 워크와 코덱스에 적용된 솔은 변경되지 않는다. 하나의 모델 제품군을 소비자 대화와 업무, 개발 환경에 동일하게 적용하기보다 이용 목적에 따라 별도로 조정하는 방향이 이어질 가능성이 있다. 오픈AI의 이번 개편으로 생성형 AI 서비스 경쟁도 모델 벤치마크 중심에서 접근성과 사용 빈도, 사실 신뢰성, 추론 비용까지 확대될 것으로 예상된다. 무료 시장에서는 이용자가 얼마나 부담 없이 AI를 반복 사용할 수 있는지가 중요해지고, 유료 시장에서는 복잡한 작업을 얼마나 정확하고 깊게 처리할 수 있는지가 구독 가치를 가를 가능성이 있다. 오픈AI는 "접근성은 기회의 범위를 결정한다"며 "이번 업데이트를 통해 더 많은 사람이 질문을 계속하고 아이디어를 발전시키며 필요한 순간 도움을 받을 수 있게 될 것"이라고 밝혔다.

2026.08.07 10:38장유미 기자

[AI는 지금] 구글·메타에 도전장…미스트랄, 기업용 AI 안전시장 본격 공략

프랑스 인공지능(AI) 기업 미스트랄AI가 기업별 정책에 맞춰 유해 콘텐츠 판정 기준을 바꿀 수 있는 소형 안전 모델을 공개하며 기업용 AI 시장 공략에 나섰다. 생성형 AI 활용이 업무 에이전트로 확대되면서 모델 성능뿐 아니라 보안과 규제 준수 역량이 주요 경쟁 요소로 떠오르자 안전 모델까지 오픈 웨이트 전략을 넓힌 모습이다. 미스트랄AI는 4일(현지시간) 공식 홈페이지를 통해 30억 개 파라미터 규모의 멀티모달 안전 분류 모델 '실드스트랄(Shieldstral)'을 아파치 2.0 라이선스로 공개했다. 실드스트랄은 텍스트와 이미지, 이용자 프롬프트와 AI 답변을 검사해 특정 안전 정책을 위반하는지를 확률 형태로 제시한다. 실드스트랄은 안전 기준을 모델에 고정하지 않고 추론 시점에 자연어로 입력하도록 설계된 것이 특징이다. 기업이 "이 콘텐츠가 개인정보를 노출하는가", "미성년자에게 보여줘도 안전한 이미지인가"와 같은 질문을 제시하면 해당 기준에 따라 콘텐츠를 판정한다. 기존 안전 모델은 폭력과 혐오, 성적 표현 등 개발사가 미리 정한 분류 체계를 주로 활용한다. 기업이 산업이나 이용자 특성에 맞춰 새로운 기준을 적용하려면 모델을 다시 학습하거나 별도의 규칙 엔진을 붙여야 한다. 반면 실드스트랄은 정책 문구만 바꿔 새로운 기준을 적용할 수 있어 금융과 의료, 공공, 교육 등 산업별 요구사항을 반영하기 쉽다. 같은 사이버 공격 관련 콘텐츠라도 일반 소비자 서비스에서는 차단하고 보안 연구 도구에서는 허용하는 식으로 서비스 목적에 따라 안전 수준을 조정할 수 있다. 텍스트와 이미지 안전 평가를 하나의 모델로 처리하는 점도 특징이다. 프롬프트와 답변을 각각 검사하거나 두 내용을 함께 평가할 수 있으며, AI가 이용자의 요청을 적절히 거부했는지와 유해한 답변을 내놨는지도 동일한 방식으로 판별한다. 모델은 '예'와 '아니요'에 해당하는 확률을 한 번의 추론으로 산출한다. 기업은 이 점수를 바탕으로 콘텐츠를 즉시 차단하거나 사람의 검토 대상으로 넘기는 등 자체 운영 기준을 설정할 수 있다. 실드스트랄은 16GB 엔비디아 그래픽처리장치(GPU) 1대에서도 구동할 수 있다. 대규모 클라우드 인프라 없이 기업 내부 서버나 프라이빗 클라우드에 배치할 수 있어 고객 대화와 내부 문서를 외부 콘텐츠 검수 서비스로 보내지 않고 처리할 수 있다. 이는 데이터 통제권을 중시하는 기업 고객을 겨냥한 구성으로 해석된다. 금융과 공공, 의료 기업은 생성형 AI를 도입하더라도 개인정보와 내부 데이터가 외부로 전송되는 것을 꺼리는 경우가 많다. 소형 오픈 웨이트 안전 모델을 내부에 구축하면 외부 안전 API 이용료와 민감한 데이터의 외부 전송 부담을 함께 줄일 수 있다. 실드스트랄 공개는 미스트랄AI의 기업용 AI 생태계 확대에도 힘을 보탤 것으로 예상된다. 기업과 개발자가 오픈 웨이트 안전 모델을 도입한 뒤 미스트랄의 생성 모델과 맞춤형 학습·평가 플랫폼 '포지(Forge)'까지 함께 검토할 가능성이 있어서다. 실드스트랄의 데이터 처리와 학습, 정렬, 평가 전 과정도 포지에서 이뤄졌다. 이는 안전 모델을 앞세워 자체 플랫폼의 기업 활용 가능성을 알리려는 전략으로 읽힌다. 이번 일로 미스트랄AI와 구글, 메타 등 기존 오픈 웨이트 안전 모델 사업자들의 경쟁도 확대될 전망이다. 구글은 텍스트용 '실드젬마'와 이미지용 '실드젬마2'를 제공하고 있으며, 메타는 라마 기반 안전 분류 모델 '라마 가드'를 공개했다. 미스트랄AI는 하나의 모델로 텍스트와 이미지, 프롬프트와 답변을 함께 처리한다는 점을 실드스트랄의 차별점으로 내세웠다. 기업이 새로운 정책을 자연어 질문으로 입력해 재학습 없이 판정 기준을 변경할 수 있다는 점도 기존 모델과의 경쟁 요소로 보고 있다. 이번 일은 AWS와 마이크로소프트 등 클라우드 사업자가 제공하는 가드레일 서비스에도 영향을 줄 수 있다. AWS는 아마존 베드록 가드레일을 통해 유해 콘텐츠와 민감정보, 금지 주제를 탐지하고 있으며 마이크로소프트도 애저 기반 콘텐츠 안전 서비스를 제공한다. 기업이 실드스트랄을 자체 인프라에 배치하면 클라우드 기반 안전 API에 대한 의존도를 낮출 수 있다. 오픈 웨이트 안전 모델이 확산할수록 클라우드 사업자도 가격과 처리 속도, 데이터 통제권, 산업별 정책 설정 기능을 강화해야 할 가능성이 커진다. 미스트랄AI는 자체 평가에서 실드스트랄이 텍스트 안전성과 거부 응답 탐지, 정책 적응성, 멀티모달 안전성 부문에서 최대 7배 큰 오픈 가드 모델과 대등하거나 높은 성능을 기록했다고 주장했다. 평가용 표본은 학습 데이터에서 제외했다고 설명했다. 미스트랄AI는 "실드스트랄은 모든 제품에 하나의 고정된 분류 체계를 적용하는 대신 서비스 맥락에 맞춰 적응하는 콘텐츠 조정을 향한 단계"라고 밝혔다.

2026.08.05 11:38장유미 기자

[AI는 지금] 中 AI 4종 쏟아지자 가격 질서 '흔들'…美 모델업체 수익성 압박

중국 인공지능(AI) 기업들이 미국 최상위 모델과 성능 격차를 좁히면서 가격 경쟁까지 주도하고 있다. 같은 성능을 더 비싸게 제공하거나, 같은 가격에 성능이 낮은 모델은 시장에서 밀려날 수 있다는 이른바 '딥시크 죽음의 구역'이 형성되며 미국 AI 기업의 가격 결정력과 중견 모델 업체의 생존 부담이 커지는 분위기다. 4일 블룸버그통신에 따르면 알리바바와 문샷AI, 딥시크, Z.ai(지푸AI) 등 중국 AI 기업들은 최근 8주 동안 고성능 모델 4종을 잇달아 공개했다. 저렴한 가격을 앞세웠던 초기 경쟁에서 벗어나 추론과 코딩, 장시간 에이전트 작업 등으로 기술 경쟁 범위를 넓히고 있다. 알리바바가 이번 주 공개한 '큐원3.8-맥스'는 앤트로픽의 주력 모델 '페이블 5'와 비슷하거나 일부 평가에서 높은 성능을 기록했다. 문샷AI의 '키미 K3'도 미국 고가 모델과 유사한 성능을 내면서 미국의 대중 반도체 수출 규제가 중국 AI 개발 속도를 충분히 늦추지 못하고 있다는 논란을 키웠다. 지난 6월에는 Z.ai의 'GLM-5.2'도 당시 글로벌 오픈소스 모델 평가에서 선두에 올랐다. 딥시크도 올 여름에 저가형 고성능 모델 'V4 플래시'를 선보이며 가격 경쟁을 다시 끌어올렸다. 이처럼 중국 기업 4곳이 짧은 기간 고성능 모델을 잇달아 내놓으면서 딥시크의 성공이 예외적인 성과가 아니라는 평가에 힘이 실리고 있다. 중국 업체 간 경쟁이 모델 출시 주기를 앞당기고 성능과 가격 경쟁력을 함께 끌어올렸다고 봐서다. 베이징에서 활동하는 기술 분석가 포 자오는 "지난해 1월 이후 가장 중요한 변화는 중국의 발전이 더 이상 한 기업의 돌발적인 성과로 보이지 않는다는 점"이라며 "최근 출시는 중국이 글로벌 최전선에 근접한 모델을 반복적으로 생산할 체계를 갖췄다는 점을 시사한다"고 말했다. 이 같은 중국 모델의 위협은 비용에서 더 뚜렷하게 나타나고 있다. 독립 AI 평가기관 아티피셜 애널리시스에 따르면 복잡한 실제 업무를 처리하는 데 드는 비용은 딥시크 V4 플래시가 0.03달러로, 앤트로픽 클로드 페이블 5의 3.15달러보다 100분의 1 이하로 낮았다. AI 에이전트처럼 모델을 반복 호출하는 업무에선 중국 모델의 가격 경쟁력이 더욱 부각되고 있다. 미국 모델이 업무 계획을 맡고 중국 모델이 실행을 담당하는 방식도 확산하는 분위기다. 상하이 스타트업 컨설팅 업체 젠젠랩스의 더못 맥그래스 창립자는 "딥시크 V4 플래시가 에이전틱 AI 업무의 경제성을 크게 바꿨다고 본다"며 "몇 달 전만 해도 중국 모델은 도구 호출이나 장시간 에이전트 업무에서 신뢰성이 떨어졌지만 지금은 상황이 달라졌다"고 밝혔다. 가격 경쟁이 거세지면서 중간 수준의 성능과 가격을 내세운 모델 업체의 입지도 좁아지고 있다. 이른바 '딥시크 죽음의 구역'을 벗어나려면 가격을 낮추거나 성능을 끌어올려야 한다는 압박도 커지는 분위기다. 이 구간에 포함된 기업은 가격을 대폭 낮추거나 고성능 모델 개발에 추가 자금을 투입해야 할 가능성이 크다. 또 GLM-5.2와 키미 K3, 큐원3.8-맥스처럼 딥시크보다 높은 성능 구간으로 이동하지 못하면 고객과 개발자를 확보하기 어려워질 수 있다. 일각에선 중국 모델의 저가 공세가 높은 수익성을 전제로 기업공개를 준비하는 오픈AI와 앤트로픽에도 부담으로 작용할 것으로 전망했다. 오픈소스 중국 모델이 확산할수록 두 회사가 높은 이용료를 유지하기 어려워지고 기업가치 산정의 전제가 되는 수익성에도 압박이 커질 수 있어서다. 중국 기업도 가격 경쟁에 따른 수익성 저하를 피하기는 어려운 상황이다. 이용자와 개발자, 기술 주도권을 먼저 확보하기 위해 단기 이익을 포기하고 있어 시장점유율 확대가 안정적인 수익으로 이어질지는 불확실하다는 평가다. 글로벌 오픈모델 기업 01.ai의 리카이푸 창립자는 "중국 오픈소스 모델이 없었다면 오픈AI와 앤트로픽은 막대한 수익을 올렸을 것"이라며 "지금은 더 저렴한 대안이 생겼다"고 말했다.

2026.08.04 16:46장유미 기자

[AI는 지금] "105분의 1 가격"…딥시크, 하네스로 AI 에이전트 판 흔든다

중국 인공지능(AI) 기업 딥시크가 대규모언어모델(LLM)을 자율형 AI 에이전트로 전환하는 소프트웨어 개발에 나섰다. 최신 경량 모델을 앞세워 미국 기업보다 낮은 가격으로 시장을 공략하는 동시에 에이전트 실행 환경까지 확보하며 경쟁 범위를 넓히려는 움직임이다. 4일 홍콩 사우스차이나모닝포스트(SCMP)에 따르면 딥시크는 현재 '딥시크 하네스' 베타 테스트에 참여할 오픈소스 프로젝트 개발자를 모집하고 있다. 딥시크 하네스팀을 이끄는 추이톈이는 지난 1일 소셜미디어를 통해 개발자 모집 계획을 공개했다. 하네스는 LLM이 여러 단계로 구성된 코드를 실행하고 복잡한 작업 절차를 추론하며 외부 도구를 자율적으로 사용할 수 있도록 모델과 실행 환경을 연결하는 소프트웨어다. 모델이 이용자의 질문에 답하는 수준을 넘어 실제 업무를 수행하려면 도구 호출과 작업 순서 관리, 오류 처리 등을 담당할 하네스가 필요하다. AI 기업들이 하네스 개발에 집중하는 이유도 에이전트의 성능이 기반 모델뿐 아니라 실행 환경의 완성도에 따라 달라지기 때문이다. 앤트로픽의 코딩 에이전트 '클로드 코드'가 시장에서 호응을 얻은 뒤 주요 AI 기업의 경쟁도 모델 성능에서 에이전트 실행 체계로 확대되고 있다. 딥시크는 지난 3월 추이를 영입해 하네스 전담 조직을 구성했다. 추이는 홍콩의 퀀트 트레이딩 기업 TSY캐피털 공동 창업자 출신으로, 미국 퀀트 투자사 제인스트리트에서 소프트웨어 엔지니어로 근무했다. 딥시크 하네스의 정식 출시 일정은 공개되지 않았다. 추이는 지난 6월 팀의 개발 목표에 비해 인력이 크게 부족하다며 여러 경로를 통해 개발자를 채용하고 있다고 밝혔다. 에이전트 사업 확대에는 저렴한 고성능 모델을 기반으로 이용자를 늘린 뒤 개발 생태계까지 확보하려는 전략이 깔린 것으로 풀이된다. AI 에이전트를 직접 개발하고 운영할 수 있는 환경을 제공하면 기업과 개발자의 딥시크 모델 사용량을 함께 끌어올릴 수 있다. 앞서 딥시크는 지난달 31일 2840억개 매개변수를 갖춘 경량 모델 'V4 플래시 0731'도 출시했다. 지난 4월 공개한 V4 시리즈를 가볍게 만든 모델로, 최신 미국 모델에 근접한 성능을 낮은 비용으로 제공하는 데 초점을 맞췄다. AI 모델 평가 플랫폼 아티피셜 애널리시스에 따르면 V4 플래시 0731은 오픈AI의 경량 모델 'GPT-5.6 루나'와 비슷한 성능을 기록했다. 오픈AI가 최근 가격을 80% 내렸지만 작업당 애플리케이션프로그래밍인터페이스(API) 비용은 딥시크가 60%가량 낮았다. V4 플래시 0731의 평균 작업당 비용은 0.03달러로 집계됐다. 작업당 3.15달러가 드는 앤트로픽의 '클로드 페이블 5'와 비교하면 약 105분의 1 수준이다. 기업들이 AI 에이전트에 모델을 적용하면 호출량이 급증하는 만큼 모델 가격 차이는 서비스 운영비와 직결될 수 있다.미국 벤처투자자 차마스 팔리하피티야는 딥시크와 미국 모델의 가격 차이를 두고 "1달러에 이용할 수 있는데 105달러를 내겠다는 최고재무책임자(CFO)나 최고경영자(CEO), 이사회 구성원은 없을 것"이라고 말했다. 딥시크는 모델 가격을 낮추는 동시에 조직 확대와 투자 유치도 추진하고 있다. 이곳은 지난 6월 전 부서 인력을 최소 2배로 늘리겠다는 계획을 밝혔으며 최근에는 투자 전 기업가치 약 700억 달러를 기준으로 신규 투자 유치를 협의하는 것으로 알려졌다. 업계 전문가는 "에이전트는 하나의 작업을 처리하는 과정에서 모델을 여러 차례 호출하기 때문에 성능 차이가 크지 않다면 비용이 모델 선택을 좌우할 수 있다"며 "딥시크가 저가 모델에 하네스까지 결합하면 미국 AI 기업들은 모델 가격뿐 아니라 개발 생태계와 운영 효율에서도 경쟁 압박을 받을 것"이라고 말했다.

2026.08.04 10:24장유미 기자

[AI는 지금] 가짜 폭격·난민 사진 쏟아지자…구글, '어스 AI 편집' 긴급 철회

구글이 위성사진에 인공지능(AI)으로 가상의 건물이나 사건 현장을 추가할 수 있는 '구글 어스' 이미지 편집 기능을 철회했다. 실제 지형을 바탕으로 폭격 피해와 원자력발전소, 난민 행렬 등을 사실처럼 꾸민 이미지가 잇따라 확산하면서 분쟁 지역의 피해를 확인하는 위성사진에 대한 신뢰까지 흔들릴 수 있다는 우려가 커졌기 때문이다. 1일 파이낸셜타임스(FT)에 따르면 구글은 최근 구글 어스에 적용한 생성형 AI 기반 이미지 편집 기능을 되돌리고 안전장치를 강화하기로 했다. 앞서 구글은 지난달 30일 이미지 생성 모델 '나노 바나나'를 구글 어스에 통합했다고 발표했다. 이용자가 원하는 장면을 문자로 입력하면 실제 위성사진 위에 AI가 생성한 사물이나 건물, 상황을 추가해 지역의 모습을 가상으로 바꿀 수 있는 기능이다. 기능 공개 직후 소셜미디어 X에서는 가자지구에 폭탄이 떨어져 분화구가 생긴 장면과 이란의 원자력발전소, 네덜란드 암스테르담에서 발생한 차량 사고 등을 묘사한 조작 이미지가 공유됐다. 멕시코 국경에 난민이 모여 있는 모습과 같은 정치·사회적 갈등을 자극할 수 있는 이미지도 제작됐다. 구글 어스는 언론인과 오픈소스정보(OSINT) 분석가가 전쟁과 재난, 군사시설 피해 등을 검증할 때 사용하는 대표적인 도구다. 현장 접근이 제한된 지역에서 촬영된 사진이나 영상의 위치를 확인하고 과거 위성사진과 비교해 피해 규모를 판단하는 기준 자료로 활용돼 왔다. 이번 기능은 일반 이미지 생성 서비스와 달리 구글 어스의 실제 위성사진에 가짜 장면을 덧입힌다는 점에서 우려를 키웠다. 지형과 도로, 건물의 위치와 규모를 그대로 유지할 수 있어 일반적인 AI 생성 이미지에서 나타나는 배경 왜곡이나 크기 오류도 발견하기 어렵기 때문이다. 생성형 AI 기능이 구글 어스 안에 직접 들어가면서 정보를 검증하는 도구와 가짜 정보를 만드는 도구가 하나의 서비스에 공존하게 됐다는 비판도 제기됐다. 조작 이미지가 구글 어스의 실제 화면을 캡처한 것처럼 유통될 경우 이용자가 진위를 구분하기 더 어려워질 수 있어서다. 샘 스톡웰 앨런튜링연구소 선임연구원은 "구글 어스는 수십 년간 언론인과 조사관이 의심스러운 이미지를 확인하는 기준 자료로 쓰였다"며 "생성형 도구를 같은 서비스에 넣으면 가짜를 판별하는 척도 자체를 오염시킬 수 있다"고 지적했다. 구글은 조작된 이미지가 다른 이용자의 구글 어스 기본 화면에는 표시되지 않았고 생성 결과물에 AI 워터마크도 삽입했다고 설명했다. 다만 정책을 위반한 것으로 보이는 이미지 캡처가 외부에 공유된 사실을 확인하고 기능을 철회하기로 했다. 하지만 워터마크만으로 허위정보 확산을 막기 어렵다는 지적도 나온다. 소셜미디어에서는 이미지가 작게 표시되거나 일부가 잘려 공유되는 경우가 많아 AI 생성 표시가 보이지 않을 수 있어서다. 또 워터마크를 삭제하거나 화면을 다시 촬영하는 방식으로 생성 흔적을 숨기는 것도 가능하다. AI로 조작한 위성사진은 군사적 긴장이나 재난 상황에서 피해 규모를 과장하거나 존재하지 않는 공격을 실제 사건처럼 꾸미는 데 활용될 수 있다는 점에서도 우려된다. 앞서 지난 3월 중동 지역에서는 이란의 드론 공격으로 카타르에 있는 미국 레이더 시설이 파괴됐다고 주장하는 AI 조작 위성사진이 X에서 확산됐다. 또 이라크 내 미군기지의 피해 규모를 실제보다 부풀린 이미지도 유통됐다. 브래디 애프릭 미국기업연구소 연구원은 "가짜 이미지가 실제 위성사진에 고정돼 있기 때문에 지형과 크기가 맞지 않는 등 AI 생성물에서 나타나는 단서가 줄어든다"며 "대부분의 이용자는 이미지를 넘겨보거나 공유할 때 AI로 만들어졌는지 확인하지 않는다"고 말했다.

2026.08.01 13:02장유미 기자

[AI는 지금] 오픈AI 이어 앤트로픽도 '실제 해킹'…AI 통제 비상

오픈AI에 이어 앤트로픽의 인공지능(AI) 모델도 사이버보안 시험 도중 외부 기관의 실제 시스템을 침해한 것으로 나타났다. 고성능 AI의 공격 능력을 확인하기 위해 안전장치를 낮춘 평가가 잇따라 보안 사고로 이어지면서 AI 모델의 인터넷 접근과 실행 권한을 통제하는 체계를 강화해야 한다는 요구가 커지고 있다. 31일 테크크런치에 따르면 앤트로픽은 최근 사이버보안 평가 기록 14만1006건을 자체 조사한 결과 '클로드' 모델이 3곳의 운영 시스템에 무단 접근한 사례 3건을 확인했다. 이번 사고는 앤트로픽이 외부 평가업체 이레귤러와 클로드의 사이버 공격 능력을 시험하는 과정에서 발생했다. 양사는 모델이 인터넷에 접속할 수 없는 격리 환경에서 평가가 진행되는 것으로 이해했지만 실제 환경에는 외부 연결 경로가 열려 있었다. 클로드는 인터넷에 접근할 수 없다는 지시를 받았지만 외부에서 발견한 실제 시스템을 시험 대상으로 판단해 공격을 이어갔다. 사고에는 클로드 오퍼스 4.7과 미토스 5, 내부 연구용 모델이 각각 관여했다. 오퍼스 4.7은 실제 운영 시스템에 접근했다는 사실을 인식하고도 인증정보를 확보하고 운영 데이터가 담긴 데이터베이스에 접근했다. 미토스 5는 실제 인터넷일 가능성을 감지했지만 시험 환경이라고 판단해 공개 파이썬 저장소 파이파이(PyPI)에 악성 패키지를 배포했다. 해당 패키지는 적발되기 전 외부 시스템에 다운로드돼 실행됐다. 반면 가장 최신인 내부 연구용 모델만 대상이 실제 시스템이라고 판단한 뒤 작업을 중단했다. 이는 AI가 현실과 시험 환경을 구분하도록 지시하는 것만으로는 사고를 막기 어렵고 외부 시스템 접근을 기술적으로 차단해야 한다는 점을 시사한다. 이에 대해 앤트로픽은 "모델이 독자적인 목표를 추구한 것은 아니고 주어진 과제를 수행하려 했다"며 "일반 서비스에 적용하는 안전 모니터링과 분류기도 모델의 순수한 사이버 능력을 측정하기 위해 이번 평가에서는 제외했다"고 설명했다. 앞서 오픈AI의 미출시 모델도 격리된 평가 환경을 벗어나 허깅페이스와 다른 외부 서비스에 접근해 논란이 됐다. 해당 사고는 미국 의회와 백악관까지 대응에 나설 정도로 파장이 컸다. 미국 의회에서는 AI 비상 중단 장치 도입을 요구하는 'AI 킬 스위치법'이 발의됐고 도널드 트럼프 대통령도 추가 보호 조치 검토 가능성을 언급했다. 오픈AI 모델은 알려지지 않은 취약점을 이용해 격리 환경을 벗어난 반면, 앤트로픽 모델은 평가 환경의 설정 오류로 열린 인터넷 경로를 통해 실제 시스템에 접근했다. 침해 경로는 달랐지만 두 사례 모두 평가 단계에서 모델의 외부 활동을 차단하지 못하면서 AI 기업의 자체 시험 환경과 외부 평가업체의 네트워크 설정, 접근 권한을 함께 검증해야 한다는 요구가 커지고 있다. 앤트로픽은 "강력한 AI 모델을 평가할 때는 그 능력에 맞는 강력한 통제가 필요하다"며 "현재 독립 평가기관 METR와 사고에 대한 제3자 검토를 진행하는 동시에 모든 책임이 우리에게 있다는 전제 아래 개선 조치를 추진하고 있다"고 밝혔다.

2026.07.31 16:53장유미 기자

[AI는 지금] 딥시크도 1GW 베팅…中 AI 경쟁, 모델서 인프라로 '확전'

중국 인공지능(AI) 기업들이 1기가와트(GW)급 데이터센터 투자에 잇따라 나서며 미국과의 경쟁 범위를 모델 성능과 가격에서 컴퓨팅 인프라로 넓히고 있다. Z.AI가 중국산 반도체로 채운 1GW급 시설을 추진하는 가운데 딥시크도 같은 규모의 데이터센터 확보에 나서면서 전력과 자국산 AI 가속기를 결합한 중국식 인프라 전략이 속도를 내는 모습이다. 31일 블룸버그통신에 따르면 딥시크는 베이징에서 북서쪽으로 약 350km 떨어진 네이멍구 우란차부에 1GW 규모의 AI 컴퓨팅 용량을 구축할 계획이다. 자체 데이터센터를 새로 짓는 동시에 다른 기업의 시설을 임차하는 방안도 추진하고 있다. 딥시크는 시설 일부를 2027년 말이나 2028년 초까지 가동하는 것을 목표로 하는 것으로 전해졌다. 우란차부에서는 지방정부 승인 내역을 기준으로 12개가 넘는 기업이 데이터센터 프로젝트를 준비하고 있다. 이처럼 우란차부가 주목받은 것은 환경 때문이다. 우란차부는 연평균 기온이 약 4도로 낮아 서버 냉각에 필요한 전력을 줄이기 유리하다. 또 중국 북부의 전력 자원을 활용할 수 있어 차이나모바일 등 여러 기업이 데이터센터 입지로 활용해 왔다. 이번 투자는 딥시크의 시설 확대를 넘어 중국 AI 기업들이 대규모 연산 자원을 직접 확보하는 흐름이 본격화됐다는 점에서 주목된다. 적은 컴퓨팅 자원으로 성능과 비용 효율을 높여온 중국 기업들도 차세대 모델 학습과 대규모 추론 서비스를 위해 안정적인 반도체와 전력 확보가 필요해졌기 때문이다. 중국 AI 기업 Z.AI도 중국산 반도체만으로 구성한 1GW급 데이터센터를 완공하고 일부 시설을 가동한 것으로 전해졌다. 이는 미국의 수출 통제로 엔비디아 최신 제품 확보가 어려워진 상황에서 대형 데이터센터를 자국산 가속기의 성능과 안정성을 검증하는 기반으로 활용하려는 전략으로 풀이된다. 딥시크가 새 데이터센터에 어떤 AI 반도체를 탑재할지는 아직 알려지지 않았다. 다만 화웨이를 비롯한 중국산 AI 가속기 비중을 높일 경우 딥시크의 투자는 모델 개발뿐 아니라 중국 반도체와 서버, 네트워크 소프트웨어 생태계 확대에도 영향을 줄 것으로 보인다. 업계 관계자는 "중국 AI 기업의 1GW급 투자는 모델 경쟁을 뒷받침할 자체 연산 기반을 확보하려는 것"이라며 "딥시크와 Z.AI의 투자가 이어지면 미·중 AI 경쟁도 모델 성능에서 전력과 반도체, 인프라 운영 능력을 겨루는 구도로 확대될 것"이라고 말했다.

2026.07.31 11:41장유미 기자

[AI는 지금] "노바 부진 잊어라"…AI 모델 경쟁 밀린 아마존, 新조직·외부 인재로 '반격'

아마존이 자체 인공지능(AI) 모델 '노바'의 부진 속에 아마존웹서비스(AWS)의 에이전틱 AI 조직을 확대하며 기업용 AI 사업 강화에 나섰다. 모델 경쟁에서 밀린 부분을 에이전트와 기업 데이터 연결 역량으로 만회하려는 움직임이다. 30일 업계에 따르면 스와미 시바수브라마니안 AWS 부사장은 이날 자신의 링크드인을 통해 '에이전틱 AI·신기술' 조직을 이끌게 됐다고 밝혔다. 새 조직은 기존 에이전트 제품을 확대하고 아직 별도 사업이나 담당 조직이 없는 초기 기술을 발굴해 AWS 서비스로 키우는 역할을 맡는다. 시바수브라마니안 부사장은 AWS에서 데이터베이스와 분석, 머신러닝 사업을 이끌며 다이나모DB와 아마존 베드록 개발에 참여했다. 이번 역할 확대를 통해 에이전트 제품 개발뿐 아니라 초기 기술의 검증과 사업화까지 총괄하게 됐다. 새 조직에는 AI 코딩 도구 '키로'와 기업용 AI 서비스 '아마존 퀵', 애플리케이션 현대화 서비스 'AWS 트랜스폼'이 포함된다. 뉴로심볼릭 AI와 기업 데이터를 연결하는 'AWS 콘텍스트'도 담당한다. 뉴로심볼릭 AI는 거대언어모델(LLM) 등 신경망에 온톨로지와 논리 추론을 결합해 환각을 줄이고 특정 산업 분야의 정확도를 높이는 기술이다. 이번 일을 통해 AWS는 키로로 소프트웨어 개발을 지원하고 AWS 트랜스폼으로 기존 시스템 전환을 자동화한다. 아마존 퀵과 AWS 콘텍스트를 통해서는 AI 에이전트가 기업 데이터와 업무 맥락을 활용해 실제 작업을 수행하도록 지원할 계획이다.이 같은 움직임은 아마존 자체 모델인 노바가 시장에서 뚜렷한 존재감을 확보하지 못한 가운데 나왔다. 비즈니스인사이더에 따르면 아마존은 기존 노바 개발 조직을 정리하고 피터 아빌 부사장이 이끄는 '프런티어 모델 연구(FMR)' 계획을 최근 사내 핵심 AI 사업으로 추진하고 있다. FMR 조직은 올해 말 열리는 연례 기술 콘퍼런스 '리인벤트' 공개를 목표로 새 모델을 개발 중인 것으로 알려졌다. 아마존은 노바 제품군 가운데 고성능 모델인 '노바 프리미어'와 통합형 멀티모달 모델 '노바 옴니'를 단계적으로 폐기할 예정인 것으로 전해졌다. 동영상 생성 모델 '노바 릴'과 이미지 생성 모델 '노바 캔버스'도 정리 대상에 포함됐다. 기존 노바 제품군을 축소하는 대신 FMR 조직에 인력과 컴퓨팅 자원을 집중해 차세대 기반모델 경쟁력을 끌어올리려는 전략으로 풀이된다. 이번 조직 개편으로 아빌 조직이 차세대 기반모델 개발을 맡는다면 시바수브라마니안 조직은 AI를 기업 고객의 실제 업무에 적용하는 제품과 서비스를 담당한다. 이는 자체 모델 성능 경쟁과 별개로 데이터 연결과 소프트웨어 개발, 시스템 전환, 업무 실행까지 AWS 안에서 제공해 기업용 AI 수요와 수익화를 확대하려는 구상이다. 이의 일환으로 AWS는 베드록에서 자체 모델인 아마존 노바뿐 아니라 앤트로픽과 메타 등 외부 모델도 제공한다. 고객이 선택한 모델을 사내 데이터와 업무 시스템에 연결하는 에이전트 사업이 확대되면 컴퓨팅과 데이터베이스, 스토리지 등 AWS 서비스 이용도 함께 늘어날 수 있다. 시바수브라마니안 부사장은 "기존 조직에 속하지 않은 기술을 발굴하고 제품으로 키우는 것이 새 조직의 역할"이라며 "에이전틱 AI는 컴퓨팅의 다음 개척지로, 뉴로심볼릭 AI와 AWS 콘텍스트는 그 시작"이라고 말했다.

2026.07.30 15:26장유미 기자

[AI는 지금] 美 의회 간 샘 알트먼, '통제불능 AI' 규제 방안 찾을까

오픈AI의 인공지능(AI) 에이전트가 보안 시험 중 격리 환경을 벗어나 외부 기업 시스템을 침해하면서 미국의 AI 규제 논의가 모델의 유해성 검증에서 자율 행동 통제로 확대되고 있다. 차기 모델 출시를 준비하는 오픈AI와 신제품 개발을 제한하지 않으려는 미국 정부 사이에서 에이전트의 권한과 외부 시스템 접근을 어디까지 통제할지가 새로운 쟁점으로 떠오른 분위기다. 30일 로이터통신에 따르면 샘 알트먼 오픈AI 최고경영자(CEO)는 29일(현지시간) 미국 워싱턴에서 상원의원들을 만나 준비 중인 차기 AI 모델에 대해 논의했다. 알트먼 CEO는 버니 모레노와 존 허스티드 상원의원을 만났으며 라파엘 워녹 상원의원 사무실도 방문했다. 상원 정보위원회 민주당 간사인 마크 워너 의원과도 면담할 예정인 것으로 전해졌다. 이번 방문은 오픈AI가 보안 시험 과정에서 AI 에이전트의 통제에 실패한 사실을 공개한 직후 이뤄졌다. 해당 에이전트는 격리 환경을 벗어나 AI 개발 플랫폼 허깅페이스의 인프라를 침해했으며, 뉴욕에 본사를 둔 클라우드 기업 모달랩스의 고객 시스템도 해킹한 것으로 알려졌다. AI 에이전트는 이용자의 명령에 따라 외부 도구와 소프트웨어를 직접 조작해 업무를 수행한다. 이 탓에 모델의 자율성이 높아질수록 잘못 부여된 권한이나 시스템 취약점을 이용해 개발사가 예상하지 못한 행동에 나설 위험도 커질 수 있다. 업계에선 이번 사고로 모델이 유해한 답변을 생성하는지를 확인하는 기존 안전성 평가만으로는 에이전트의 위험을 충분히 검증하기 어렵다고 우려했다. 또 외부 인터넷과 기업 시스템에 대한 접근 권한, 격리 환경의 안정성, 인증정보 관리 등을 안전성 평가에 포함해야 한다고도 요구했다. 다만 알트먼 CEO는 상원의원들과 해킹 사고도 일부 논의했지만 회동의 주된 의제는 아니었다고 설명했다. 오픈AI는 사고와 관련해 미국 정부 관계자들과 별도의 논의를 이어가고 있는 것으로 전해졌다. 알트먼 CEO는 "해킹 사건에 대해 의원들과 조금 이야기했다"며 "그 사안과 관련해 여러 회의를 진행하고 있다"고 말했다. 도널드 트럼프 미국 대통령도 오픈AI 에이전트 사고와 관련해 AI 통제 방안을 검토하고 있다고 밝혔다. 그러나 AI 기업의 신제품 개발을 제한하는 방식에는 신중한 태도를 나타내 고위험 모델과 에이전트를 대상으로 한 별도 안전성 검증 체계가 논의될 가능성이 커졌다. 또 미국 정부는 첨단 AI 모델에 대한 안전성 평가와 검토 절차 마련을 추진하고 있다. 오픈AI가 차기 모델 출시를 준비하는 시점에 정부와 의회의 안전성 요구까지 높아지면서 알트먼 CEO의 워싱턴 방문에도 관심이 쏠리고 있다. 향후 규제 논의는 모델 출시 전 성능 평가를 넘어 에이전트의 실제 운용 과정까지 넓어질 것으로 예상된다. 외부 시스템 접근 권한을 제한하고 사고 발생 시 기업의 보고 의무와 제3자 검증을 강화하는 방안도 주요 의제로 다뤄질 수 있다. 트럼프 대통령은 "AI 통제 방안을 살펴보고 있다"며 "개발자들이 새로운 제품을 만드는 것을 제한하고 싶지는 않다"고 말했다.

2026.07.30 09:57장유미 기자

[AI는 지금] '키미 K3'로 판 키운 中, 오픈웨이트 앞세워 글로벌 AI 규범 선점 나섰다

중국이 인공지능(AI) 모델 경쟁에서 한발 더 나아가 글로벌 AI 규범을 주도하려는 움직임을 본격화하고 있다. 모델 증류와 지식재산권, 학습 데이터 출처 등 국제 기준이 마련되지 않은 분야에서 자국의 오픈웨이트 모델 확산을 규범 선점의 계기로 활용하려는 모습이다. 29일 사우스차이나모닝포스트(SCMP)에 따르면 중국 연구기관과 관영매체들은 문샷AI가 이달 공개한 '키미 K3'를 계기로 AI 거버넌스 기준 마련을 서둘러야 한다고 주장했다. 오픈웨이트 모델의 활용이 확대되고 있지만 다른 모델의 출력물을 학습에 이용할 수 있는 범위와 AI 결과물의 권리 귀속, 학습 데이터와 기술의 출처를 확인하는 기준은 명확하지 않다는 이유에서다. 가장 논쟁이 큰 분야는 모델 증류다. 모델 증류는 성능이 높은 AI의 출력 결과를 활용해 더 작고 효율적인 모델을 학습시키는 기술이다. 다만 경쟁사 모델의 결과물을 어디까지 이용할 수 있는지, 해당 방식으로 개발한 모델을 독자 기술로 인정할 수 있는지를 두고 기업과 국가마다 입장이 엇갈리고 있다. 특정 모델이 다른 AI의 출력물을 학습에 활용했는지 확인할 공인된 방법도 부족하다. 개발사가 학습 과정과 데이터 구성을 공개하지 않으면 기술의 출처를 외부에서 입증하기 어렵고, 의혹이 제기돼도 지식재산권 침해 여부를 판단할 공통 기준이 없는 셈이다.이에 상하이 장장 플랫폼경제연구원은 모델과 학습 데이터의 출처를 추적할 수 있는 기술을 개발하고 이를 국제 분쟁 해결과 표준 수립에 활용해야 한다고 제안했다. 또 모델 증류의 허용 범위와 AI 결과물의 소유권, 기술 출처를 확인하는 기준이 마련되지 않은 상황에서 검증 체계를 먼저 갖춰야 한다고 주장했다. 이처럼 중국이 규범 마련에 적극적으로 나서는 데는 자국 모델의 해외 확산을 제도적 영향력으로 연결하려는 의도가 있는 것으로 풀이된다. 중국산 오픈웨이트 모델을 사용하는 개발자와 기업이 늘어나는 시점에 라이선스와 안전성 평가, 기술 출처 확인 기준을 먼저 제시하면 향후 국제 규범 논의에서도 영향력을 넓힐 수 있어서다. 또 중국 측은 오픈웨이트 모델의 확산을 유지하면서도 기술 오용과 지식재산권 침해를 줄일 수 있는 규범이 필요하다고 보고 있다. 이를 위해 모든 모델에 동일한 공개 원칙을 적용하기보다 위험 수준과 활용 목적에 따라 공개 범위와 이용 조건을 달리하자는 방안을 제시했다. 일반적인 연구·개발에는 모델과 도구를 폭넓게 공개하되 고위험 분야에는 접근 제한과 별도의 안전성 검증을 적용하는 방식이다. 키미 K3에도 이 같은 전략이 반영됐다. 문샷AI는 모델을 내려받아 수정하고 재배포할 수 있도록 허용하면서도 일정 규모 이상의 매출을 올리는 사업자에는 별도의 상업 조건을 적용하고 있다. 해외 이용자를 확보할 수 있는 개방성은 유지하면서 기술 통제권과 수익 기반도 함께 지키려는 구조다. 이 같은 분위기 속에 중국은 오픈웨이트 모델 확산과 안전 관리를 함께 달성할 수 있다는 점을 내세워 국제 AI 규범 논의에서 영향력을 확대하려는 움직임을 보이고 있다. 자국 모델의 이용자를 늘리는 데서 그치지 않고 개방 범위와 권리 보호, 안전성 검증 기준까지 함께 제시해 글로벌 AI 생태계의 규칙을 설계하는 쪽으로 경쟁 범위를 넓히고 있다. 업계 관계자는 "글로벌 AI 거버넌스 경쟁에서는 먼저 움직이고 더 나은 규칙을 제시하는 쪽이 주도권을 잡게 될 것"이라며 "자국의 기술적 성과를 국제적으로 통용될 수 있는 제도와 표준으로 전환하는 경쟁도 한층 치열해질 것"이라고 강조했다.

2026.07.29 16:53장유미 기자

[AI는 지금] AT&T '1조 토큰' 돌린 MS…AI 인프라 경쟁, '비용'으로 이동

마이크로소프트가 AT&T와 손잡고 오픈모델과 이기종 그래픽처리장치(GPU)를 결합한 기업용 AI 인프라 전략을 강화하고 있다. 기업들의 AI 활용이 실험을 넘어 대규모 데이터 처리와 산업 특화 모델 개발로 확대되면서 모델 선택권과 비용 효율, 신속한 GPU 확보를 함께 제공하는 클라우드 플랫폼 경쟁에도 속도가 붙는 분위기다. 29일 업계에 따르면 마이크로소프트는 지난 23 공식 뉴스룸을 통해 AT&T가 자사 AI 개발 플랫폼 '마이크로소프트 파운드리'를 활용해 통신 특화 인공지능(AI) 모델 '오픈 텔코 2.0'을 개발한 사례를 공개했다. 오픈 텔코 2.0은 통신망과 국제 표준, 네트워크 운영 지식을 학습해 범용 거대언어모델(LLM)의 통신 분야 전문성을 보완한 모델이다. AT&T는 특정 모델 하나에 의존하지 않고 작업별로 여러 오픈모델을 배치했다. 마이크로소프트의 '파이-4'는 데이터 정제와 합성 데이터 생성에, 'OSS-120B'는 고난도 추론에, 구글의 '젬마 4'는 모델 개발 전반에 활용했다. 파이-4가 처리한 데이터만 매달 7000억 토큰을 넘었다. 인프라도 단일 그래픽처리장치(GPU)에 묶지 않았다. AT&T는 마이크로소프트 파운드리의 관리형 컴퓨팅 서비스를 통해 GPU 약 530개를 사용했으며 이 가운데 430개를 AMD '인스팅트 MI300X'로 구성했다. AMD와 엔비디아 GPU를 함께 운용해 모델과 작업 특성에 따라 비용과 성능을 조정했다. 마이크로소프트는 관리형 인프라를 통해 GPU 확보와 모델 배포 기간도 수주에서 수일로 단축했다. 기업이 직접 서버를 구축·운영하는 부담을 줄여 데이터 준비와 모델 개발에 집중할 수 있도록 했다. 제프 부디에 허깅페이스 제품 담당 부사장은 "마이크로소프트 파운드리는 최신 오픈모델과 AMD·엔비디아 GPU를 한곳에 모아 기업이 적합한 모델과 하드웨어를 고른 뒤 수주가 아닌 수시간 안에 배포할 수 있도록 지원한다"고 말했다. AT&T는 오픈 텔코 2.0 개발 과정에서 GSMA 문서와 합성 데이터를 포함해 약 1조 토큰을 처리했으며 이 가운데 약 4000억 토큰을 모델 학습에 사용했다. 마이크로소프트는 프런티어 모델 대신 파이-4 등 오픈모델로 합성 데이터를 생성해 수천만 달러를 절감했다고 밝혔다. 이번 사례는 기업용 AI의 비용 구조가 모델 이용료에만 머물지 않는다는 점도 드러냈다. 수천억 토큰을 처리하는 단계에선 GPU 조달과 배포 속도, 모델별 연산 효율, 인프라 운영 부담이 전체 사업비와 개발 기간을 좌우할 수 있어서다. 마이크로소프트는 여러 모델과 GPU를 하나의 플랫폼에서 운영하는 방식을 앞세워 대규모 AI 워크로드 수요를 공략할 계획이다. 마크 오스틴 AT&T 데이터사이언스·AI 담당 부사장은 "수천억 토큰을 처리하는 규모에서는 인프라 자체가 해결해야 할 과제가 된다"며 "파운드리 매니지드 컴퓨트를 통해 대규모 GPU 자원을 확보하면서 인프라 관리보다 오픈 텔코 2.0 개발에 집중할 수 있었다"고 밝혔다.

2026.07.29 10:00장유미 기자

[AI는 지금] "코딩 멈추지 마세요"…오픈AI·앤트로픽, AI 사용 한도 경쟁 나선 이유

오픈AI와 앤트로픽이 인공지능(AI) 코딩 도구의 이용 한도를 잇달아 확대하며 개발자 시장 선점 경쟁에 나섰다. 모델 성능이 빠르게 상향 평준화되는 가운데 개발자가 작업을 중단하지 않고 얼마나 오래 도구를 사용할 수 있는지가 새로운 경쟁 요소로 떠오르고 있다. 28일 업계에 따르면 오픈AI에서 AI 코딩 에이전트 '코덱스' 개발을 이끄는 티보 소티오는 전날 자신의 엑스(X)를 통해 코덱스와 '챗GPT 워크'의 모든 유료 이용자 사용 한도를 초기화했다고 밝혔다. 이번 조치는 정식 요금제 개편이나 무제한 이용 허용보다 이용자가 이미 소진한 코덱스와 챗GPT 워크의 한도를 다시 채워주는 일시적 조치로 보인다. 이처럼 오픈AI는 이용자 증가와 서비스 장애 보상 등을 이유로 한도 초기화를 반복하고 있다. 비공식 모니터링 사이트 '코덱스 리셋 모니터'에 따르면 오픈AI '코덱스'는 최근 30일간 10여 차례 초기화된 것으로 파악됐다. AI 코딩 에이전트는 소스코드 저장소 탐색과 파일 수정, 테스트, 오류 해결을 반복해 일반적인 챗봇 이용보다 많은 토큰과 연산 자원을 사용한다. 여러 에이전트를 동시에 실행하면 한도 소진 속도도 빨라져 개발 작업이 중간에 멈출 수 있다. 또 코딩 에이전트의 이용 방식이 복잡해지면서 충분한 사용량을 확보해야 할 필요성도 커지고 있다. 오픈AI 연구진의 코덱스 이용 분석에 따르면 올해 상반기 활성 이용자는 5배 이상 증가했으며 매주 이용자의 10% 이상이 에이전트 3개 이상을 동시에 운용한 것으로 나타났다. 숙련 개발자가 8시간 넘게 수행할 만한 작업을 AI에 맡기는 이용자도 빠르게 늘었다. 이에 맞서 앤트로픽도 컴퓨팅 자원을 늘려 '클로드 코드' 이용 한도를 확대하고 있다. 지난 5월에는 프로·맥스·팀·엔터프라이즈 요금제의 5시간 단위 이용 한도를 2배로 늘리고, 일부 요금제에 적용하던 혼잡 시간대 제한도 없앴다. 클로드 오퍼스 모델의 애플리케이션 프로그래밍 인터페이스(API) 호출 한도도 상향했다. 이 같은 조치는 고성능 모델을 활용한 코딩 작업이 늘면서 토큰 소비와 한도 소진 속도도 빨라진 데 따른 대응으로 풀이된다. 모델 성능이 높아져도 토큰 사용량이 함께 늘면 개발자가 실제로 처리할 수 있는 업무량은 줄어들 수 있어서다. 앤트로픽도 '클로드 코드'의 기본 추론 강도를 높게 설정한 뒤 응답 지연과 과도한 토큰 사용이 발생하자 설정을 조정하고 전체 구독자의 이용 한도를 초기화한 바 있다. 국내 개발자 커뮤니티에서도 신형 모델의 성능보다 토큰 사용량과 기존 업무환경과의 호환성을 우려하는 반응이 나왔다. 기존 모델에 맞춰 설계한 명령 체계와 개발 규칙, 검증 절차를 새 모델에 그대로 적용하면 불필요한 탐색이나 반복 작업이 늘어날 수 있어서다. 업계 관계자는 "AI 코딩 시장은 벤치마크 성능만 비교하는 단계를 지나 한도에 걸리지 않고 얼마나 오래 작업을 이어갈 수 있는지를 따지는 시장으로 바뀌고 있다"며 "오픈AI와 앤트로픽의 사용량 확대도 개발자의 작업 중단을 줄이고 자사 도구의 이용 습관을 먼저 확보하려는 경쟁으로 볼 수 있다"고 말했다.

2026.07.28 17:14장유미 기자

[AI는 지금] 오픈AI 떠난 '두뇌'에 베팅…엔비디아, 차세대 AI 주역 선점

엔비디아가 오픈AI의 기술과 제품 개발을 이끌다 독립한 핵심 인재들을 잇달아 자사 생태계로 끌어들이고 있다. 유력 연구진에 투자와 차세대 인공지능(AI) 시스템을 함께 제공하며 미래 연산 수요와 기술 주도권을 선점하려는 전략으로 풀이된다. 28일 파이낸셜타임스(FT) 등 주요 외신에 따르면 엔비디아는 일리야 수츠케버와 미라 무라티가 설립한 AI 스타트업에 대규모 자본과 차세대 '베라 루빈' 시스템을 제공했다. 챗GPT 개발에 참여한 리암 페더스가 세운 과학 AI 기업에도 투자하며 오픈AI 출신 인재들과의 접점을 넓히고 있다. 엔비디아는 수츠케버가 이끄는 세이프 슈퍼인텔리전스(SSI)에 약 50억 달러를 투자하고 장기 전략적 협력을 맺었다. SSI는 베라 루빈을 도입해 앞으로 12개월간 연산 능력을 10배 확대하고 엔비디아와 연구 시스템을 공동 최적화할 계획이다. SSI는 2024년 설립 이후 제품이나 연구 결과를 공개하지 않았지만 지난해 20억 달러를 조달하며 기업가치 320억 달러를 인정받았다. 수츠케버는 오픈AI 공동창업자이자 전 수석과학자로 GPT와 챗GPT 개발을 이끈 핵심 연구자다. 엔비디아는 지난 3월 오픈AI 최고기술책임자(CTO) 출신 무라티가 설립한 싱킹 머신스 랩에도 투자했다. 양사는 최소 1기가와트(GW) 규모의 베라 루빈 시스템을 구축하고 프런티어 모델의 학습·추론 인프라를 공동 설계하기로 했다. 수츠케버와 무라티는 오픈AI의 연구와 제품 개발을 이끈 핵심 인물이다. 엔비디아는 두 사람이 독립해 세운 기업에 잇달아 투자하고 차세대 그래픽처리장치(GPU)를 공급하며 초기 연구 단계부터 협력 관계를 구축하고 있다. 엔비디아의 투자 범위는 과학 AI로도 확대되고 있다. 엔비디아는 오픈AI 연구부문 부사장 출신 페더스가 공동 설립한 페리오딕 랩스의 3억 달러 규모 초기 투자에도 참여했다. 이 회사는 AI와 로봇 실험실을 결합해 신소재와 과학적 발견을 자동화하는 기술을 개발하고 있다. 이처럼 엔비디아는 투자와 함께 GPU·네트워크·소프트웨어를 공급하며 AI 스타트업과의 협력을 확대하고 있다. 이는 유망 기업을 차세대 플랫폼의 초기 고객으로 확보하는 동시에 실제 연구 현장의 요구를 제품 개발에 반영하려는 움직임으로 풀이된다. 이 같은 투자 방식은 AI 반도체 업계 전반으로 확산하고 있다. AMD는 최근 앤트로픽에 최대 50억 달러를 투자하고 최대 2GW 규모의 '인스팅트 MI450' 기반 시스템을 공급하기로 했다. 양사는 앤트로픽 모델을 AMD GPU에 최적화하고 소프트웨어 플랫폼 'ROCm' 개선에도 협력할 계획이다. 수츠케버는 "우리는 규모를 확대할 가치가 있는 연구 성과를 확보했다"며 "엔비디아의 대규모 컴퓨팅 시스템을 활용하면 이를 더 큰 규모로 확장할 수 있다"고 말했다.

2026.07.28 10:43장유미 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

삼성·SK, 中낸드 생산거점 강화…내년까지 설비투자 집행

호불호 갈렸던 페라리 첫 전기차 '루체' 韓상륙

[단독] 롯데시네마 합정 폐점…14년만에 '역사 속으로'

독파모, 3차 심사부터 일반 기업도 사용한다

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.