• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
국감2026
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'스페이스XAI'통합검색 결과 입니다. (4건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI는 지금] 속도조절론 속 쏟아진 신모델…AI 3사 승부처는

인공지능(AI) 개발 속도를 둘러싼 논쟁이 커지는 가운데 글로벌 AI 기업 3곳이 이틀 사이 신모델을 잇따라 공개했다. 앤트로픽과 오픈AI, 스페이스XAI는 나란히 성능을 높이면서도 안전성과 비용 효율, 에이전트 역량에 각각 무게를 뒀다. 22일(현지시간) 오픈AI는 'GPT-6 솔·루나', 앤트로픽은 '클로드 오퍼스 5.5'를 각각 공개했다. 하루 전인 21일에는 스페이스XAI가 '그록 4.7'을 선보였다. 같은 시기에 나왔지만 각사가 택한 전략은 달랐다. 앤트로픽은 외부 평가와 행동 감사 등 안전 검증을 강화했다. 오픈AI는 GPT-6 아스트라에서 확보한 기술을 더 빠르고 저렴한 솔·루나로 가져왔고 스페이스XAI는 복잡한 작업을 장시간 수행하고 결과를 스스로 확인하는 능력을 키웠다. 성능 경쟁에서는 오퍼스 5.5가 앞섰다. 글로벌 AI 평가기관 아티피셜 애널리시스의 종합 성능 지표(AAII)에서 최고 설정 기준 오퍼스 5.5는 58점을 기록했다. GPT-6 솔은 48점, 그록 4.7은 46점이었다. 다만 오픈AI와 스페이스XAI는 각각 비용 효율과 장시간 에이전트 업무를 주요 경쟁력으로 강조했다. 최근 AI 개발 속도를 조절해야 한다는 주장에는 세 회사 수장 모두 공감을 나타냈다. 다만 실제 안전 대응은 검증 방식과 적용 강도에서 차이가 있었다. 속도조절 필요성을 제기한 앤트로픽은 오퍼스 5.5를 외부 기관에 사전 평가받고 약 2000개 상황을 대상으로 행동 감사를 진행했다. 오픈AI는 솔·루나가 자사 최고 위험 단계에는 이르지 않았다고 판단해 기존 GPT-5.6 솔·루나와 같은 안전장치를 적용했다. 스페이스XAI는 그록 4.7에 새로운 안전체계를 도입했지만 공식 발표에는 외부 기관의 사전 평가나 개발 속도를 늦춘 조치에 대한 내용은 포함되지 않았다. 앤트로픽은 '안전'…외부 검증·고위험 작업 제한 앤트로픽은 오퍼스 5.5에서 외부 검증과 고위험 작업 통제를 강화했다. 회사는 이를 프런티어 AI 개발 속도조절을 제안한 이후 처음 공개한 모델이라고 소개했다. 출시 전에는 미국 비영리 AI 평가기관 모델평가위협연구소(METR)와 프런티어 디자인 등 외부 기관의 평가를 받았다. 내부에서도 모델이 위험하거나 의도하지 않은 행동을 보이는지 자동으로 점검했다. 통제 범위를 벗어나려는 행동도 따로 살폈다. 오퍼스 5.5가 정해진 경계를 우회하려 한 빈도는 기존 오퍼스 5와 미토스 5.1보다 약 85% 낮았다. 확인된 시도는 모두 심각도가 낮았으며 모델이 스스로 이를 보고했다고 회사 측은 설명했다. 악용 가능성이 큰 분야에는 사용 제한을 뒀다. 대부분의 사이버보안 작업은 이전 모델인 오퍼스 4.8이 처리하도록 했으며 일부 생물학 관련 고위험 기능에는 이용자 검증 절차를 적용했다. 성능과 비용도 개선됐다. 초기 평가자가 20만줄 규모의 프로그램 코드를 점검하고 오류를 수정하도록 하자 오퍼스 5.5는 3시간 안에 작업을 마쳤다. 기존 오퍼스 5는 같은 작업에 20시간 이상 걸렸다. 일반적인 작업 비용은 40% 낮아졌고 출력 속도는 30% 이상 빨라졌다. 안전 평가의 한계도 확인됐다. 오퍼스 5.5가 일부 상황에서 자신이 시험받고 있다는 사실을 의심하는 징후를 보였기 때문이다. 앤트로픽은 "모델을 배포하기 전에 모든 실패 가능성을 평가로 찾아내는 방법은 아직 해결되지 않았다"고 설명했다. 오픈AI는 '효율'…아스트라 기술 더 싸게 오픈AI는 아스트라에서 확보한 기술을 더 낮은 비용의 솔과 루나로 가져왔다. 최상위 모델의 성능을 최고가 제품에만 두기보다 작업 난도와 비용에 따라 선택할 수 있도록 GPT-6 제품군을 세분화했다. 솔은 복잡한 코딩과 에이전트 업무처럼 높은 성능이 필요한 작업을 겨냥한다. 루나는 빠른 응답과 낮은 비용이 중요한 대량 작업에 초점을 맞췄다. 오픈AI는 루나를 자사 모델 가운데 가장 빠르고 비용 효율적인 모델로 소개했다. 가격은 GPT-5.6 솔·루나의 프로모션 가격보다 50% 낮췄다. 솔은 입력 토큰 100만개당 2달러, 출력 10달러이며 루나는 각각 0.1달러와 0.5달러다. 안전 대응에서는 기존 체계를 유지했다. 오픈AI는 솔과 루나를 사이버보안과 생물·화학 분야에서 '높은 수준'으로 분류했지만 아스트라가 도달한 사이버보안 '중대한 수준'에는 미치지 않는다고 평가했다. 이에 따라 GPT-5.6 솔·루나와 같은 수준의 안전장치를 적용했다. 아스트라에서 개발한 정렬 기술은 새 모델에도 적용했다. 오픈AI는 솔과 루나가 GPT-5.6 계열보다 탈옥 공격에 대한 저항성과 정렬 평가에서 개선된 결과를 보였다고 밝혔다. 오픈AI는 위험이 일정 수준에 접근하면 실제 개발 속도를 늦춘 경험도 있다. 지난달 아스트라가 중대한 수준의 사이버보안 능력에 도달할 가능성이 나타나자 배포 예정 모델의 강화학습을 2주간 중단했다. 최대 규모의 프런티어 강화학습도 보류하고 보안과 모니터링 체계를 보강했다. 스페이스XAI는 '에이전트'…수시간짜리 업무까지 겨냥 스페이스XAI는 그록 4.7의 장시간 업무 수행과 자기 검증 능력을 강화했다. 기존 그록 4.6보다 큰 기반 모델을 사용하고 강화학습 기간을 늘려 수시간이 걸리는 문제의 학습 비중을 높였다. 모델은 긴 작업을 이어가면서 앞서 내린 판단과 결과를 다시 확인하도록 훈련됐다. 긴 맥락을 관리하는 능력도 높여 코딩뿐 아니라 문서 작성과 전문 지식 업무처럼 여러 단계를 거치는 작업을 겨냥했다. 외부 평가에서도 에이전트 업무 성능이 높아졌다. 아티피셜 애널리시스의 장기 지식 업무 평가 'AA 브리프케이스'에서 그록 4.7은 1657점을 기록해 그록 4.6보다 111점 높았다. 코딩 에이전트 지표도 9점 오른 56점을 기록했다. 가격은 입력 토큰 100만개당 2달러, 출력은 6달러부터 시작한다. 출력 속도를 두 배 높인 별도 모델도 제공한다. 안전 측면에서는 새로운 안전체계를 적용했다. 스페이스XAI는 자체 사이버보안 평가 '해커벤치 0.3'에서 위험한 이중용도 요청 가운데 3.3%만 허용했으며 자사가 평가한 모델 가운데 탈옥 공격 저항성이 가장 높았다고 밝혔다. 머스크도 최근 AI 개발 속도를 늦출 필요성에 공감을 나타냈다. 다만 이번 그록 4.7 공식 발표에서는 개발 속도를 낮추거나 외부 기관의 사전 평가를 받았다는 내용은 공개되지 않았다. 스페이스XAI는 "그록 4.7은 어려운 작업을 더 오래 수행하고 자신의 작업을 더 꼼꼼히 확인할 수 있다"며 "지금까지 가장 잘 조정된 안전장치를 갖췄다"고 밝혔다.

2026.09.23 14:37김동원 기자

스페이스XAI, 코딩·전문 업무 강화한 '그록 4.7' 출시…가격은 전작 그대로

스페이스XAI가 코딩과 전문 지식 업무 성능을 강화한 새 인공지능(AI) 모델을 내놨다. 장시간 작업 수행과 결과 검증 능력을 높이면서도 기존 모델과 같은 가격을 유지한 것이 특징이다. 스페이스XAI는 코딩과 지식 업무에 특화한 최신 AI 모델 그록 4.7을 출시했다고 공식 홈페이지를 통해 22일 밝혔다. 그록 4.7은 커서와 그록 빌드를 비롯해 그록 API와 외부 코딩 하네스, 모델 라우터, 클라우드 플랫폼에서 이용할 수 있다. 그록 4.7에는 기존 버전인 그록 4.6보다 큰 새로운 기반 모델이 적용됐다. 수 시간 동안 수행해야 하는 고난도 작업 비중을 높여 강화학습을 진행하면서 결과물을 스스로 검증하고 긴 컨텍스트를 처리하는 능력을 개선했다. 모델 코딩 성능도 전작보다 높아진 것으로 전해졌다. 장시간 코딩 작업을 평가하는 커서벤치 4.0에서 그록 4.7은 46.3%를 기록했다. 이는 그록 4.6의 40.4%와 GPT-5.6 솔의 41.7%를 웃돈 수치다. 페이블 5.1은 51.8%다. 그록 4.7은 딥SWE v1.1에서 높은 추론 강도 기준 71.0%를 기록했다. GPT-5.6 솔은 72.7%였으며 페이블 5.1은 70.0%를 기록했다. 전기공학 성능을 평가하는 EE벤치에서는 그록 4.7이 64.0%로 비교 대상 가운데 가장 높은 점수를 냈다. 신규 모델은 전문 업무 수행 능력도 개선됐다. 수 시간 규모 사무 업무를 평가하는 AA 브리프케이스 v1.1에서 그록 4.7은 1657점을 기록해 그록 4.6의 1546점과 GPT-5.6 솔의 1487점을 넘어섰다. 법률 업무를 평가하는 하비 리걸 에이전트 벤치마크에서도 19.6%로 비교 모델 가운데 가장 높은 점수를 기록했다. 그록 4.7은 문서와 프레젠테이션 제작 성능도 강화됐다. 회사는 변호사와 간호사, 금융 분석가 등 전문직이 수행하는 업무를 평가하는 GDP밸과 AA 브리프케이스에서 그록 4.7이 전작보다 높은 성능을 냈으며 다른 최상위 모델과 비슷한 수준을 보였다고 설명했다. 스페이스XAI는 그록 4.7 안전성도 강화했다고 밝혔다. 그록 4.7에는 새로운 안전장치 체계가 적용됐으며 내부 평가에서 위험한 요청 거부와 탈옥 공격 저항 성능이 지금까지 테스트한 모델 가운데 가장 높았다. 래치바이오의 바이오안전성 벤치마크에서는 62.4%를 기록했다. 사이버보안 분야에서는 정상적인 보안 업무를 과도하게 차단하지 않으면서 위험한 요청을 걸러내는 데 초점을 맞췄다. 해커벤치 v0.3에서는 위험한 이중용도 프롬프트 가운데 허용된 비율이 3.3%로 나타났다. 일부 사이버보안 파트너에게는 방어 연구를 위한 레드팀 기능도 초대 방식으로 제공한다. 그록 4.7 가격은 입력 토큰 100만개당 2달러부터 시작한다. 출력 토큰은 100만개당 6달러다. 이는 그록 4.6과 같은 수준이다. 출력 속도를 2배 높인 고속 버전은 기본 모델보다 2배 높은 가격으로 제공된다. 스페이스XAI는 "그록 4.7은 코딩과 지식 업무를 위한 가장 강력한 모델"이라며 "어려운 작업을 더 오래 수행하고 자신의 결과물을 더 꼼꼼하게 검토하며 지금까지 가장 정교하게 조정된 안전장치를 갖췄다"고 밝혔다.

2026.09.22 10:19김미정 기자

[AI는 지금] 커서 품은 스페이스XAI, 코딩 AI에 꽂혔다…오픈AI·앤트로픽 추격 본격화

스페이스XAI가 커서와 공동 개발한 새 인공지능(AI) 모델 '그록 4.5'를 공개하며 기업용 AI 시장 공략에 속도를 내고 있다. 코딩에 강점을 둔 모델을 금융, 법률, 보안 업무로 확장해 오픈AI와 앤트로픽이 주도해 온 기업용 AI 경쟁에 뛰어든 모습이다. 9일 블룸버그통신 등 주요 외신에 따르면 스페이스XAI는 이달 8일(현지시간) 커서와 공동 개발한 그록 4.5를 선보였다. 이 모델은 두 회사가 함께 만든 첫 AI 모델로, 소프트웨어 개발뿐 아니라 데이터 분석, 금융, 법률 업무처럼 장시간 실행과 도구 활용이 필요한 작업에 초점을 맞췄다. 터미널 기반 코딩 성능을 측정하는 주요 벤치마크에선 앤트로픽 '클로드 오퍼스 4.8'과 비슷한 수준을 기록하며 오픈AI 'GPT-5.5'와 경쟁할 수 있는 성능을 확보했다는 평가도 나왔다. 이번 일을 기점으로 커서는 스페이스XAI가 기업용 AI 시장을 파고드는 데 필요한 데이터와 유통 채널을 동시에 제공할 예정이다. 개발자가 실제 업무에서 코드를 작성하고 수정하고 테스트하는 과정이 플랫폼 안에 축적돼 있어서다. 스페이스XAI는 커서 생태계를 통해 실사용 데이터를 모델 고도화에 활용하고, 완성된 모델을 개발자 업무 환경 안에서 바로 배포할 수 있게 할 계획이다. 이 같은 스페이스XAI의 움직임은 오픈AI와 앤트로픽에 새로운 압박 요인이 될 것으로 보인다. 현재 앤트로픽은 클로드 코드를 앞세워 개발자 시장에서 입지를 넓혔고, 오픈AI도 코덱스로 코딩 에이전트 경쟁을 강화하고 있는 상태다. 스페이스XAI가 커서를 통해 코딩 도구 안에서 모델을 직접 유통하면 기업용 AI 경쟁은 모델 성능뿐 아니라 업무 환경 장악력과 배포 속도까지 따지는 구도로 바뀔 가능성이 있다. 이번 일은 스페이스X의 운영 효율도 높일 수 있을 것으로 보인다. 로켓, 위성, 스타링크, 데이터센터를 운영하는 만큼, 앞으로 그록 4.5를 내부 개발과 운영 자동화에 적용해 엔지니어링 생산성은 물론 위성망 관리와 우주 인프라 운영 효율까지 높일 수 있을 것으로 기대된다. 다만 보안 기능 강화는 변수로 꼽힌다. 그록 4.5는 취약점 분석과 보안 점검에 활용될 수 있는 사이버보안 역량을 갖춘 모델로 소개됐다. 이에 기업 보안 업무 자동화에는 도움이 될 수 있지만 악용 가능성에 대한 규제 당국의 감시도 커질 수 있다. 기업 고객은 고성능 AI 모델을 도입할 때 접근 통제, 감사 추적, 책임 소재를 함께 따질 수밖에 없을 것으로 보인다. 업계에선 스페이스XAI의 이번 행보가 AI 모델 경쟁의 기준을 바꿀 수 있다고 보고 있다. 커서가 보유한 개발자 접점과 스페이스X의 컴퓨팅 인프라가 결합되면 모델 개발, 배포, 수익화까지 이어지는 속도가 빨라질 수 있다는 이유에서다.업계 관계자는 "기업용 AI 경쟁은 누가 더 똑똑한 모델을 갖췄느냐보다 실제 업무 흐름 안에 얼마나 깊게 들어가느냐의 싸움으로 바뀌고 있다"며 "스페이스XAI가 커서를 통해 개발자 접점을 확보한 만큼 금융, 법률, 보안 업무로 확장할 수 있을지가 오픈AI·앤트로픽과의 경쟁력을 가를 것"이라고 말했다.

2026.07.09 11:21장유미 기자

스페이스X 품에 안긴 xAI, 연구진 50명 넘게 떠났다…그록 경쟁력 시험대

일론 머스크가 스페이스X와 xAI를 결합해 우주·통신·인공지능(AI)을 아우르는 'AI 인프라 제국' 구축에 나섰지만, 통합 초기부터 핵심 인재 이탈이라는 변수를 맞았다. 프런티어 AI 모델 개발을 담당해 온 연구진이 경쟁사로 빠져나가면서 스페이스XAI의 기술 경쟁력과 조직 안정성이 동시에 시험대에 오른 모습이다. 15일 IT 전문 매체 디인포메이션에 따르면 스페이스XAI에서 최근 연구원과 엔지니어 50명 이상이 이탈했다. 퇴사자에는 코딩, 월드모델, 그록 음성 기능 등 주요 기술 조직의 리더들이 포함됐다. xAI는 머스크가 오픈AI와 구글 딥마인드에 맞서겠다며 설립한 AI 기업이다. 챗봇 '그록'을 앞세워 실시간 정보 검색, 코드 생성, 음성 기능 등을 확장해 왔다. 지난 2월 스페이스X에 합병된 뒤에는 조직 개편과 인력 이동이 잇따르며 기술 리더십 유지 여부가 주요 쟁점으로 떠올랐다. 머스크는 최근 통합 조직의 이름을 '스페이스XAI'로 바꾸고 스페이스X 출신 인사를 주요 리더십에 배치한 것으로 알려졌다. 업계에선 최근 스페이스XAI에서 핵심 모델 개발 조직의 인력이 줄어들고 있다는 점을 주목하고 있다. 특히 사전학습 조직은 대형언어모델(LLM)의 기본 성능과 확장성을 좌우하는 영역으로 꼽힌다. 모델 설계와 데이터 처리, 컴퓨팅 자원 운용, 학습 안정화 역량이 함께 요구되는 만큼 숙련된 연구진 이탈은 그록 후속 모델 개발 속도와 성능 개선에 부담으로 작용할 수 있다. 이 같은 인력 이탈은 글로벌 AI 인재 쟁탈전과도 맞물려 있다. 앞서 메타는 지난 2월 이후 xAI 출신 연구진과 엔지니어 최소 11명을 채용했다. 오픈AI 최고기술책임자(CTO) 출신 미라 무라티가 창업한 싱킹머신스랩도 xAI 출신 최소 7명을 영입한 것으로 전해졌다. 앤트로픽 역시 xAI 공동창업자 출신 인력을 포함해 일부 연구진을 채용한 것으로 알려졌다. 업계 관계자는 "프런티어 모델 개발 경험을 갖춘 연구 인력은 공급이 제한적인 데다 빅테크와 신생 AI 연구소가 동시에 확보 경쟁을 벌이고 있다"며 "xAI의 조직 개편과 인력 이탈은 경쟁사 입장에서는 전력을 보강할 수 있는 기회가 될 수 있다"고 분석했다. 이처럼 스페이스XAI의 인력들이 이탈하는 배경으로는 머스크 특유의 고강도 근무 문화도 거론된다. 실제 머스크는 최근 일부 팀에 촉박한 모델 학습 기한과 강도 높은 근무 방식을 요구한 것으로 전해졌다. 테슬라와 스페이스X에서 성과를 낸 속도전 방식이 AI 연구 조직에도 적용됐지만, 장기간 실험과 반복 검증이 필요한 모델 개발 문화와 충돌했을 가능성이 높다. 조직 성격 변화에 따른 불확실성도 변수로 거론된다. xAI는 합병 전 독립 AI 연구소 성격이 강했지만, 스페이스X와 결합한 뒤 우주, 위성인터넷, 데이터센터, AI 서비스를 연계하는 조직으로 역할이 달라질 수 있다는 관측이 나온다. 이 과정에서 일부 연구 인력이 기술 방향성과 역할 변화에 부담을 느꼈을 가능성도 있다. 보상 요인도 일부 영향을 미쳤을 가능성이 거론된다. 스페이스X는 그간 직원들이 보유 주식을 비공개로 매각할 수 있는 기회를 정기적으로 제공해 왔다. 또 기업공개(IPO) 기대감이 커지면서 일부 직원들이 지분 유동화 가능성을 고려했을 수 있다. 이 같은 분위기 탓에 스페이스XAI의 향후 사업 방향에도 변화가 생길지 주목된다. 그록을 앞세운 프런티어 모델 개발을 계속 강화할지, 스페이스X의 우주·통신·데이터센터 인프라와 결합한 AI 제품·서비스 확장에 더 무게를 둘지를 두고 업계의 해석은 엇갈리고 있다. 또 컴퓨팅 자원과 데이터센터 인프라를 실제 모델 성능으로 연결할 연구 인력과 조직 역량 확보는 주요 과제로 꼽힌다. 업계 관계자는 "프런티어 모델 경쟁에서는 컴퓨팅 자원만큼 이를 설계하고 학습시키는 핵심 연구 인력이 중요하다"며 "xAI가 스페이스X의 인프라를 등에 업더라도 연구 조직 안정성이 흔들리면 그록의 차세대 모델 경쟁력에도 영향을 줄 수 있다"고 말했다.

2026.05.15 10:51장유미 기자

  Prev 1 Next  

지금 뜨는 기사

이시각 헤드라인

가상공간 넘어 생성현실로…피지컬 AI·로봇 미래 본다

보고 집고 옮긴다…몸 가진 AI, 유통·물류 어떻게 바꾸나

"명륜당-대부업체 한몸"...공정위 과징금 148억 철퇴

삼성전자, P5 첫 양산라인 구축 속도…장비 도입 내년 2분기로 앞당겨

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.