• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'지푸AI'통합검색 결과 입니다. (23건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[유미's 픽] 업스테이지 中 모델 도용 논란 가열…'국대 AI' 검증 기준 시험대

정부에서 추진 중인 '독자 인공지능(AI) 파운데이션 모델 프로젝트'에 참가한 업스테이지의 중국 모델 도용·파생 의혹이 제기된 후 논쟁이 기술 공방과 검증 기준 논의로 확대되고 있다. 이번 사안이 업스테이지를 넘어 이번 프로젝트 '정예 5팀'에 선발된 경쟁사들에게도 영향을 미칠지 주목된다. 2일 업계에 따르면 업스테이지는 이날 오후 3시 서울 강남역 인근에서 '솔라 오픈 100B'의 개발 과정 전반을 검증하는 공식 행사를 진행할 예정이다. 이 자리에는 김성훈 업스테이지 대표와 이번 모델 개발에 참여한 관계자, 참석을 희망한 70여 명의 업계 전문가들이 참석할 예정이다. 업스테이지 측은 '솔라 오픈 100B'의 중국 모델 표절을 주장한 고석현 사이오닉에이아이 대표도 공개적으로 초청했다. 이번 일은 고 대표가 지난 1일 깃허브를 통해 업스테이지의 '솔라 오픈 100B'의 기술 분석 보고서를 공개한 것이 발단이 됐다. '솔라 오픈 100B'는 지난 달 30일 업스테이지가 '독자 AI 파운데이션 모델' 1차 성과 발표회에서 공개한 모델이다. 고 대표는 '솔라 오픈 100B'가 중국 지푸AI의 'GLM-4.5-에어(Air)' 모델에 기반을 둔 파생 모델이라고 의혹을 제기하며 유감을 표했다. '독자 AI 파운데이션 모델' 프로젝트가 우리나라 AI 주권 확립을 위한 국가대표 AI 선발전인 데다 '프롬 스크래치(100% 독자 개발)' 준수가 공식 참여 조건으로 명시돼 있어서다. 이번 의혹이 사실일 경우 업스테이지는 자격 미달로 5개 팀 중 첫 탈락 1순위에 오르게 된다. 이에 업스테이지는 공개 검증회를 곧바로 열어 논란 잠재우기에 나섰다. 특히 이번에 학습에 사용한 중간 체크포인트(checkpoint)와 AI 모델 학습 과정과 실험 결과를 기록·관리하는 도구인 '웨이츠 앤 바이어시스(Weights & Biases·wandb)'를 모두 공개한다고 밝히는 초강수를 뒀다. '웨이츠 앤 바이어시스'는 블랙박스와 유사한 것으로, 로그 누락·사후 조작이 힘든 것으로 알려졌다. '프롬 스크래치' 공방 본격화…'가중치 유사성'이 쟁점 이번에 고 대표가 제기한 의혹의 핵심은 두 모델의 가중치 구조 유사성이다. 그는 공개한 보고서를 통해 '솔라 오픈 100B'와 'GLM-4.5-에어'의 레이어별 파라미터를 비교한 결과, 신경망 구성 요소 중 하나인 레이어놈(LayerNorm)에서 매우 높은 수준의 유사도가 관측됐다고 주장했다. 또 이를 근거로 프롬 스크래치 방식으로 학습된 모델이라면 나타나기 어려운 수치라며 중국 모델을 기반으로 일부 가중치를 보존한 파생 모델일 가능성을 제기했다. 고 대표는 '솔라 오픈 100B'의 구동 코드 일부에서 GLM 모델과 동일한 설정 코드가 발견됐다고도 주장했다. 특히 'GLM-4.5-에어'가 46개 레이어 구조를 갖는 모델임에도 48개 레이어 구조인 '솔라 오픈 100B'의 코드에 GLM 전용 레이어 예외 처리 구문이 남아 있다는 점을 문제 삼았다. 여기에 논란이 제기된 이후 깃허브 저장소의 라이선스 파일에 중국 지푸AI 관련 저작권 문구가 병기된 점 역시 의혹을 키우는 대목으로 지목했다. 업스테이지는 이러한 주장에 대해 "기술적 사실과 다르다"며 정면 반박하고 있다. 회사 측은 레이어놈 유사성만으로 모델 파생 여부를 단정하는 것은 무리가 있고, 코드 내 일부 유사한 표현 역시 오픈소스 생태계에서 통용되는 관행이나 호환성 확보 과정에서 발생할 수 있는 문제라는 입장이다. 라이선스 표기 변경에 대해서도 법적 검토 과정에서의 정비 차원이라는 설명이다. 도용 단정은 이르다…업계 "종합 검증 필요" 업계와 학계에서는 이번 논쟁을 둘러싸고 신중론이 동시에 제기되고 있다. 레이어놈 파라미터는 초기값과 학습 특성상 구조와 학습 목표가 유사한 대규모 언어모델에서 높은 유사도가 나타날 수 있어 단일 지표만으로 도용 여부를 판단하기는 어렵다는 지적이다. 실제 도용 여부를 가리려면 어텐션의 Q·K·V 가중치나 레이어 전반의 구조적 일치 여부, 학습 경로에 대한 종합적인 검증이 필요하다는 의견도 나온다.또 업계에선 고석현 대표의 문제 제기에 대해 단일 지표만으로 도용 여부를 단정하는 데에는 한계가 있다는 다수 의견도 나오고 있다. 특히 이승현 포티투마루 부사장은 사이오닉에이아이의 분석이 기술적으로 충분한 근거를 갖췄는지에 대해 의문을 제기하며, 현재 공개된 자료를 토대로 업스테이지의 '프롬 스크래치' 주장에 더 무게를 두는 모습을 보였다. 이 부사장은 "프롬 스크래치 여부는 모델 가중치가 어떻게 형성됐는지에 관한 기술적 문제로, 라이선스 표기나 소버린 AI 논의는 별도의 정책적 판단 영역"이라며 "레이어놈이나 임베딩과 같은 보조 파라미터의 유사성은 구조와 학습 목표가 유사한 대규모 언어모델(LLM)에서 통계적으로 나타날 수 있다"고 말했다. 이에 고석현 대표 역시 이날 또 다른 게시글을 통해 기술적 유사성 문제와 별도로 이번 사안을 소버린 AI 관점에서 바라봐야 한다는 입장을 강조하며 업스테이지 논란에서 한 발 물러서는 모습을 보였다. 그는 해외, 특히 중국 모델의 코드와 구조를 적극적으로 학습·참고하는 방식이 정부 주도의 독자 AI 파운데이션 모델 사업 취지에 부합하는지에 대한 근본적인 질문을 던지며 기술적 도용 여부와는 별개로 정책적 기준에 대한 논의가 필요하다고 주장했다. 업스테이지 논란, 다른 정예 5팀에도 '설명 책임' 부담 일각에선 이번 사안이 업스테이지 한 곳에 그치지 않고 독자 AI 파운데이션 모델 프로젝트에 참여 중인 다른 '정예 5팀'에도 적잖은 영향을 미칠 수 있다는 관측이 나온다. LG AI연구원, 네이버클라우드, NC AI, SK텔레콤 등 다른 참여 기업들 역시 향후 모델 공개 과정에서 개발 경로와 외부 모델 활용 여부, 프롬 스크래치의 정의에 대해 보다 명확한 설명을 요구받을 가능성이 커졌다는 평가다. 정부의 대응에도 관심이 쏠린다. 현재 독자 AI 파운데이션 모델 프로젝트는 성능과 활용 가능성을 중심으로 평가가 이뤄져 왔지만, 이번 논란을 계기로 학습 경로와 개발 과정에 대한 검증 기준을 보다 구체화해야 한다는 목소리가 커지고 있다. 일각에서는 중간 체크포인트 제출이나 학습 로그 관리·보관 의무화 등 제도적 보완이 필요하다는 지적도 제기된다. 업계 관계자는 "이번 논쟁은 특정 기업의 공방을 넘어 독자 AI를 어떤 기준으로 검증할 것인지에 대한 시험대가 되고 있다"며 "업스테이지의 공개 검증 결과에 따라 다른 참여 기업들과 정부 역시 개발 투명성과 설명 책임의 수준을 다시 설정해야 할 상황에 놓일 수 있다"고 말했다.

2026.01.02 13:28장유미 기자

[유미's 픽] 뿔난 업스테이지, '솔라 오픈 100B' 中 모델 파생 의혹에 공개 검증 '맞불'

정부에서 추진 중인 '독자 인공지능(AI) 파운데이션 모델 프로젝트'에 참가한 업스테이지가 첫 성과를 공개한 후 중국 모델을 복사해 미세 조정한 결과물로 추정되는 모델을 제출했다는 의혹에 휩싸였다. 업스테이지는 억울함을 표하며 모델 공개 검증 행사와 함께 향후 의혹 제기에 대해 강경 대응에 나설 것을 시사했다. 1일 업계에 따르면 고석현 사이오닉에이아이 대표는 이날 자신의 소셜 미디어(SNS)에 깃허브 리포트를 게재하며 업스테이지 '솔라 오픈 100B'가 중국 지푸(Zhipu) AI의 'GLM-4.5-에어'에서 파생된 모델이라고 주장했다. 고 대표는 "국민 세금이 투입된 프로젝트에서 중국 모델을 복사해 미세 조정한 결과물로 추정되는 모델이 제출됐다"며 "상당히 큰 유감"이라고 말했다. 이번 논란은 이날 오후 1시께 올라온 깃허브 리포트가 발단이 됐다. 이 리포트는 '솔라 오픈 100B'와 'GLM-4.5-에어'의 가중치 구조를 통계적으로 비교 분석한 결과를 담고 있다. 앞서 업스테이지는 지난 달 30일 독자 파운데이션 모델 '솔라 오픈 100B'를 LM 아레나 방식으로 해외 유명 모델들과 비교해 공개하며 '프롬 스크래치(From Scratch)'를 기반으로 개발했다고 소개했다. 프롬 스크래치는 AI 모델을 처음부터 직접 개발한다는 뜻으로, 데이터 수집과 모델 아키텍처 설계, 학습, 튜닝까지 모든 것을 자체적으로 수행하는 방식이다. 하지만 리포트 작성자는 '솔라 오픈 100B'와 'GLM-4.5-에어' 두 모델의 레이어별 파라미터 유사도를 측정한 결과 일부 계층에서 매우 높은 수준의 유사성이 관측됐다고 설명했다. 또 동일 모델 내부 레이어 비교보다 솔라와 GLM 간 동일 레이어 비교에서 더 높은 유사도가 나타났다고 주장하며, 이를 근거로 솔라 오픈 100B가 GLM-4.5-에어에서 파생됐다고 결론 내렸다. 다만 일각에서는 해당 분석이 두 모델의 학습 과정이나 개발 경로를 직접 확인한 것이 아니라는 점에서 해석에 신중할 필요가 있다는 지적이 나온다. 공개된 모델 가중치를 기반으로 한 사후적 통계 비교 방식으로 진행된 데다 실제 학습에 사용된 데이터셋, 학습 로그, 내부 코드베이스 등은 검증 대상에 포함되지 않았기 때문이다. 특정 가중치가 그대로 복사됐거나 모델 바이너리 차원에서 직접적인 공유가 있었다는 증거 역시 이번에 제시되지 않았다. 이 같은 의혹 제기에 대해 업스테이지는 즉각 반박에 나섰다. 고 대표가 게시물을 올린 지 2시간 후 김성훈 업스테이지 대표는 자신의 페이스북을 통해 "솔라 오픈 100B가 중국 모델을 복사해 미세 조정한 결과물이라는 주장은 사실과 다르다"며 "해당 모델은 명백히 프롬 스크래치 방식으로 학습됐다"고 강조했다. 그러면서 김 대표는 오는 2일 오후 3시 서울 강남역 부근에서 솔라 오픈 100B의 개발 과정을 공개적으로 검증받겠다고 밝혔다. 이 자리에는 의혹을 제기한 고석현 대표를 포함해 추가 검증에 참여하고 싶은 업계 및 정부 관계자들을 초청할 계획이다. 또 업스테이지 측은 이후에도 이 같은 의혹이 제기될 경우 더 강경하게 대응할지에 대해서도 내부 검토에 착수했다. 김 대표는 "학습에 사용한 중간 체크포인트(checkpoint)와 AI 모델 학습 과정과 실험 결과를 기록·관리하는 도구인 '웨이츠 앤 바이어시스(Weights & Biases·wandb)'를 모두 공개할 예정"이라며 "명확한 검증 절차를 공개해 사실 관계를 바로잡도록 할 것"이라고 말했다. 업계에서는 이번 공개 검증이 논란의 분수령이 될 수 있다는 평가를 내놨다. 실제 학습 체크포인트와 로그가 공개될 경우 '솔라 오픈 100B'가 특정 시점에서 외부 모델을 기반으로 파인튜닝됐는지, 독립적인 학습 경로를 거쳤는지를 보다 명확히 확인할 수 있기 때문이다. 동시에 통계적 유사성만으로 모델 복제 여부를 단정하기는 어렵다는 신중론도 제기된다. 대규모 언어모델 개발 과정에서는 유사한 아키텍처와 데이터, 학습 레시피를 사용할 경우 높은 유사도가 나타날 수 있어서다. 또 지식 증류(distillation)나 합성 데이터 활용 여부에 따라 통계적 패턴이 겹칠 가능성도 존재한다는 지적도 나온다. 업계 관계자는 "이번 논란이 주목받는 이유는 해당 모델이 정부 예산이 투입되는 '독자 AI 파운데이션 모델 프로젝트'의 결과물이기 때문"이라며 "사업 취지상 해외 모델에 대한 기술적 의존 여부와 개발 과정의 투명성은 핵심적인 검증 대상이 될 수밖에 없다"고 설명했다. 그러면서 "결국 이번 사안의 핵심은 통계 분석을 둘러싼 해석 논쟁을 넘어 실제 개발 과정에 대한 객관적 검증으로 옮겨가고 있다"며 "업스테이지가 예고한 공개 검증을 통해 솔라 오픈 100B의 학습 경로와 독립성이 어느 수준까지 입증될지에 많은 관심이 쏠리고 있다"고 덧붙였다.또 다른 관계자는 "이번 논란이 특정 기업의 문제를 넘어 독자 AI 파운데이션 모델 사업 전반의 검증 기준을 끌어올리는 계기가 될 수 있다"며 "다른 참여 기업들 역시 향후 모델 공개 과정에서 학습 출처와 개발 경로에 대한 설명 책임이 더 커질 가능성이 있다"고 말했다.

2026.01.01 18:09장유미 기자

中 AI 선두주자 지푸, 오픈소스 모델 공개…美 제재 속 'AI 굴기' 가속

중국 인공지능(AI) 선두주자 지푸AI가 오픈AI 수준의 성능을 갖춘 거대언어모델(LLM)을 오픈소스로 공개하며 실리콘밸리에 도전장을 던졌다. 29일 로이터 등 외신에 따르면 지푸AI는 지난 28일 3천550억개 파라미터를 갖춘 파운데이션 모델 '지엘엠-4.5(GLM-4.5)'를 오픈소스로 출시했다. 이 모델은 복잡한 추론과 코딩, 도구 사용 능력을 단일 시스템에 통합해 AI 에이전트 구동에 최적화됐다. 이 모델은 '전문가 혼합(MoE)' 아키텍처를 채택해 효율을 극대화했다. 전체 3천550억개 매개변수 중 실제 연산에는 320억 개만 활성화된다. 15조 개에 달하는 방대한 토큰으로 사전학습을 거쳤고 이후 코딩과 에이전트 행동에 특화된 8조개 토큰으로 미세조정을 완료했다. 성능은 세계 최상위권으로 평가된다. 엠엠엘유 프로(MMLU Pro) 등 12개 대표 벤치마크 종합 점수에서 세계 3위권에 진입했다. 특히 매개변수 대비 성능 효율을 나타내는 '파레토 프론티어'에 위치해 동급 모델 중 최고의 효율을 입증했다. 이 모델은 MIT 라이선스에 따라 상업적 이용이 전면 허용된다. 공개 시연에서는 모델이 직접 웹 검색을 해 보고서를 만들거나 '플래피 버드' 게임을 자율적으로 플레이했다. 주제만 입력하면 자동으로 파워포인트 슬라이드를 제작하는 기능도 선보여 콘텐츠 자동화 잠재력을 과시했다. 한 중국 매체는 이를 두고 "오픈소스는 중국 AI가 '코너에서 추월하기' 위해 선택한 핵심 전략"이라며 "커뮤니티 협력과 투명성을 통해 기술 격차를 빠르게 좁히려는 시도"라고 분석했다.

2025.07.29 17:08조이환 기자

  Prev 1 2 Next  

지금 뜨는 기사

이시각 헤드라인

네카오 'AI 수익화' 시점 변했다...네이버는 시작, 카카오는 내년

AI 학과 늘리기만으론 부족…"모든 전공에 AI 역량 심어야"

유니폼부터 AI 로봇 드로잉까지…무료 KT스포츠 팝업 가보니

AI규제는 풀고 OTT는 발목 잡고…'영화 6개월 홀드백' 논란

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.