• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
국감2026
AI페스타26
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'AI경쟁'통합검색 결과 입니다. (4건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI는 지금] 앤트로픽, 오픈AI '가성비 전략'에 맞불…소넷 5.5 공개

앤트로픽이 더 빠르고 비용을 낮춘 인공지능(AI) 모델 '클로드 소넷 5.5'를 내놓으며 오픈AI와 가성비 경쟁에 나섰다. 앤트로픽은 28일(현지시간) 자사 블로그를 통해 클로드 소넷 5.5를 출시했다고 밝혔다. 이전 모델인 소넷 5보다 출력 속도가 30% 이상 높였고 같은 작업을 처리하는 비용은 최대 30% 줄였다. 소넷 5.5의 가격은 오픈AI가 최근 출시한 GPT-6 솔과 같다. 두 모델 모두 100만 토큰당 입력 2달러, 출력 10달러다. 소넷 5.5는 기존 소넷 5와 토큰 가격은 같지만 같은 작업에 사용하는 토큰을 줄여 실제 작업 비용을 낮췄다. 소넷 5.5는 최고 성능 모델인 오퍼스 5.5보다 빠르고 저렴하게 사용할 수 있는 모델이다. 복잡한 판단이 필요한 작업보다 문서 작성과 코드 수정 등 일상적인 업무를 빠르게 처리하는 데 초점을 맞췄다. 오픈AI GPT-6 솔도 최고 성능 모델인 GPT-6 아스트라보다 가격을 낮추면서 성능과 비용 균형을 맞춘 모델이다. 오픈AI는 지난 22일 솔을 출시하며 복잡한 코딩과 AI 에이전트 업무에 활용할 수 있다고 밝혔다. 가격은 두 모델이 같지만 비용을 낮춘 방식은 다르다. 오픈AI는 GPT-6 솔의 API 가격을 이전 GPT-5.6 솔보다 50% 낮췄다. 앤트로픽은 소넷 5의 토큰 가격을 그대로 유지하면서 같은 작업에 필요한 토큰을 줄였다. 소넷 5.5는 코딩과 실제 업무 수행 능력에서도 이전 모델보다 높은 점수를 기록했다. AI가 명령줄 환경에서 여러 단계의 코딩 작업을 수행하는 능력을 평가하는 터미널벤치 4.0에서 70.6%를 기록했다. 소넷 5는 10.3%, 상위 모델인 오퍼스 5.5는 66.4%였다. 44개 직업과 9개 산업의 업무를 평가하는 GDPval-AA v2.1에서는 1844점을 기록해 오퍼스 5.5의 1846점에 근접했다. 컴퓨터를 직접 조작해 작업하는 능력을 평가하는 OS월드 2.1에서도 소넷 5.5는 80.1%, 오퍼스 5.5는 81.8%를 기록했다. 차트를 읽고 이해하는 능력을 평가하는 차토그래피에서는 이전 세대와 격차가 컸다. 소넷 5는 15.6%에 그쳤지만 소넷 5.5는 61.6%를 기록했다. 비용 대비 성능도 이전 모델보다 높아졌다. 소넷 5.5는 낮거나 중간 수준의 추론 강도에서도 일부 평가에서 소넷 5의 최고 점수를 넘어섰다. 코딩 평가인 프런티어코드에서는 높은 추론 강도에서 소넷 5보다 약 10점 높은 점수를 냈다. 각각 작업에 든 비용은 소넷 5의 약 10%, 7% 수준이었다. 다만 앤트로픽은 벤치마크 점수가 실제 성능을 모두 보여주는 것은 아니라고 밝혔다. 정답이 명확하지 않고 오랜 시간 판단을 이어가야 하는 복잡한 업무에서는 오퍼스 5.5가 여전히 소넷 5.5보다 뛰어나다고 설명했다. 성능 향상에 맞춰 안전장치도 추가했다. 소넷 5.5는 소넷 계열 가운데 처음으로 상위 모델에 적용하던 사이버보안 안전장치를 적용했다. 위험도가 높은 사이버보안 요청이 들어오면 이전 모델인 소넷 5가 대신 처리하도록 했다. 다른 AI가 클로드 답변을 대량으로 수집해 성능을 모방하는 증류 공격에도 대응했다. 앤트로픽은 수천 개 가짜 계정을 이용해 답변을 수집하는 공격을 막기 위해 소넷 계열 최초로 안전 분류기를 적용했다. 모델이 이용자의 의도와 다르게 행동하는지도 점검했다. 약 1850개 상황을 대상으로 자동 행동 감사를 진행한 결과 대부분의 정렬과 오용 방지, 정직성 평가에서 소넷 5와 같거나 개선된 결과를 기록했다고 밝혔다. 소넷 5.5는 클로드 앱과 클로드 코드, 클로드 플랫폼에서 사용할 수 있다. 아마존웹서비스(AWS)와 구글 클라우드, 마이크로소프트 애저에서도 제공된다. 앤트로픽은 "소넷 5.5는 소넷 5보다 더 명확하게 글을 쓰고 초기 테스터들은 소넷 5보다 협업하기 좋은 파트너라고 평가했다"며 "속도가 빨라져 덜 복잡한 작업을 빠르게 반복하는 데도 적합하다"고 설명했다.

2026.09.29 08:51김동원 기자

[AI는 지금] 속도조절론 속 쏟아진 신모델…AI 3사 승부처는

인공지능(AI) 개발 속도를 둘러싼 논쟁이 커지는 가운데 글로벌 AI 기업 3곳이 이틀 사이 신모델을 잇따라 공개했다. 앤트로픽과 오픈AI, 스페이스XAI는 나란히 성능을 높이면서도 안전성과 비용 효율, 에이전트 역량에 각각 무게를 뒀다. 22일(현지시간) 오픈AI는 'GPT-6 솔·루나', 앤트로픽은 '클로드 오퍼스 5.5'를 각각 공개했다. 하루 전인 21일에는 스페이스XAI가 '그록 4.7'을 선보였다. 같은 시기에 나왔지만 각사가 택한 전략은 달랐다. 앤트로픽은 외부 평가와 행동 감사 등 안전 검증을 강화했다. 오픈AI는 GPT-6 아스트라에서 확보한 기술을 더 빠르고 저렴한 솔·루나로 가져왔고 스페이스XAI는 복잡한 작업을 장시간 수행하고 결과를 스스로 확인하는 능력을 키웠다. 성능 경쟁에서는 오퍼스 5.5가 앞섰다. 글로벌 AI 평가기관 아티피셜 애널리시스의 종합 성능 지표(AAII)에서 최고 설정 기준 오퍼스 5.5는 58점을 기록했다. GPT-6 솔은 48점, 그록 4.7은 46점이었다. 다만 오픈AI와 스페이스XAI는 각각 비용 효율과 장시간 에이전트 업무를 주요 경쟁력으로 강조했다. 최근 AI 개발 속도를 조절해야 한다는 주장에는 세 회사 수장 모두 공감을 나타냈다. 다만 실제 안전 대응은 검증 방식과 적용 강도에서 차이가 있었다. 속도조절 필요성을 제기한 앤트로픽은 오퍼스 5.5를 외부 기관에 사전 평가받고 약 2000개 상황을 대상으로 행동 감사를 진행했다. 오픈AI는 솔·루나가 자사 최고 위험 단계에는 이르지 않았다고 판단해 기존 GPT-5.6 솔·루나와 같은 안전장치를 적용했다. 스페이스XAI는 그록 4.7에 새로운 안전체계를 도입했지만 공식 발표에는 외부 기관의 사전 평가나 개발 속도를 늦춘 조치에 대한 내용은 포함되지 않았다. 앤트로픽은 '안전'…외부 검증·고위험 작업 제한 앤트로픽은 오퍼스 5.5에서 외부 검증과 고위험 작업 통제를 강화했다. 회사는 이를 프런티어 AI 개발 속도조절을 제안한 이후 처음 공개한 모델이라고 소개했다. 출시 전에는 미국 비영리 AI 평가기관 모델평가위협연구소(METR)와 프런티어 디자인 등 외부 기관의 평가를 받았다. 내부에서도 모델이 위험하거나 의도하지 않은 행동을 보이는지 자동으로 점검했다. 통제 범위를 벗어나려는 행동도 따로 살폈다. 오퍼스 5.5가 정해진 경계를 우회하려 한 빈도는 기존 오퍼스 5와 미토스 5.1보다 약 85% 낮았다. 확인된 시도는 모두 심각도가 낮았으며 모델이 스스로 이를 보고했다고 회사 측은 설명했다. 악용 가능성이 큰 분야에는 사용 제한을 뒀다. 대부분의 사이버보안 작업은 이전 모델인 오퍼스 4.8이 처리하도록 했으며 일부 생물학 관련 고위험 기능에는 이용자 검증 절차를 적용했다. 성능과 비용도 개선됐다. 초기 평가자가 20만줄 규모의 프로그램 코드를 점검하고 오류를 수정하도록 하자 오퍼스 5.5는 3시간 안에 작업을 마쳤다. 기존 오퍼스 5는 같은 작업에 20시간 이상 걸렸다. 일반적인 작업 비용은 40% 낮아졌고 출력 속도는 30% 이상 빨라졌다. 안전 평가의 한계도 확인됐다. 오퍼스 5.5가 일부 상황에서 자신이 시험받고 있다는 사실을 의심하는 징후를 보였기 때문이다. 앤트로픽은 "모델을 배포하기 전에 모든 실패 가능성을 평가로 찾아내는 방법은 아직 해결되지 않았다"고 설명했다. 오픈AI는 '효율'…아스트라 기술 더 싸게 오픈AI는 아스트라에서 확보한 기술을 더 낮은 비용의 솔과 루나로 가져왔다. 최상위 모델의 성능을 최고가 제품에만 두기보다 작업 난도와 비용에 따라 선택할 수 있도록 GPT-6 제품군을 세분화했다. 솔은 복잡한 코딩과 에이전트 업무처럼 높은 성능이 필요한 작업을 겨냥한다. 루나는 빠른 응답과 낮은 비용이 중요한 대량 작업에 초점을 맞췄다. 오픈AI는 루나를 자사 모델 가운데 가장 빠르고 비용 효율적인 모델로 소개했다. 가격은 GPT-5.6 솔·루나의 프로모션 가격보다 50% 낮췄다. 솔은 입력 토큰 100만개당 2달러, 출력 10달러이며 루나는 각각 0.1달러와 0.5달러다. 안전 대응에서는 기존 체계를 유지했다. 오픈AI는 솔과 루나를 사이버보안과 생물·화학 분야에서 '높은 수준'으로 분류했지만 아스트라가 도달한 사이버보안 '중대한 수준'에는 미치지 않는다고 평가했다. 이에 따라 GPT-5.6 솔·루나와 같은 수준의 안전장치를 적용했다. 아스트라에서 개발한 정렬 기술은 새 모델에도 적용했다. 오픈AI는 솔과 루나가 GPT-5.6 계열보다 탈옥 공격에 대한 저항성과 정렬 평가에서 개선된 결과를 보였다고 밝혔다. 오픈AI는 위험이 일정 수준에 접근하면 실제 개발 속도를 늦춘 경험도 있다. 지난달 아스트라가 중대한 수준의 사이버보안 능력에 도달할 가능성이 나타나자 배포 예정 모델의 강화학습을 2주간 중단했다. 최대 규모의 프런티어 강화학습도 보류하고 보안과 모니터링 체계를 보강했다. 스페이스XAI는 '에이전트'…수시간짜리 업무까지 겨냥 스페이스XAI는 그록 4.7의 장시간 업무 수행과 자기 검증 능력을 강화했다. 기존 그록 4.6보다 큰 기반 모델을 사용하고 강화학습 기간을 늘려 수시간이 걸리는 문제의 학습 비중을 높였다. 모델은 긴 작업을 이어가면서 앞서 내린 판단과 결과를 다시 확인하도록 훈련됐다. 긴 맥락을 관리하는 능력도 높여 코딩뿐 아니라 문서 작성과 전문 지식 업무처럼 여러 단계를 거치는 작업을 겨냥했다. 외부 평가에서도 에이전트 업무 성능이 높아졌다. 아티피셜 애널리시스의 장기 지식 업무 평가 'AA 브리프케이스'에서 그록 4.7은 1657점을 기록해 그록 4.6보다 111점 높았다. 코딩 에이전트 지표도 9점 오른 56점을 기록했다. 가격은 입력 토큰 100만개당 2달러, 출력은 6달러부터 시작한다. 출력 속도를 두 배 높인 별도 모델도 제공한다. 안전 측면에서는 새로운 안전체계를 적용했다. 스페이스XAI는 자체 사이버보안 평가 '해커벤치 0.3'에서 위험한 이중용도 요청 가운데 3.3%만 허용했으며 자사가 평가한 모델 가운데 탈옥 공격 저항성이 가장 높았다고 밝혔다. 머스크도 최근 AI 개발 속도를 늦출 필요성에 공감을 나타냈다. 다만 이번 그록 4.7 공식 발표에서는 개발 속도를 낮추거나 외부 기관의 사전 평가를 받았다는 내용은 공개되지 않았다. 스페이스XAI는 "그록 4.7은 어려운 작업을 더 오래 수행하고 자신의 작업을 더 꼼꼼히 확인할 수 있다"며 "지금까지 가장 잘 조정된 안전장치를 갖췄다"고 밝혔다.

2026.09.23 14:37김동원 기자

[AI는 지금] 마이크로소프트 AI 수장 "중국 핑계로 AI 안전 미뤄선 안 돼"

미국과 중국의 인공지능(AI) 경쟁이 거세지는 가운데 마이크로소프트(MS) AI 수장이 기술 경쟁과 별개로 양국 간 안전 협력을 제안했다. 무스타파 술레이만 MS AI 최고경영자(CEO)는 20일(현지시간) CNN과 인터뷰에서 "중국과의 AI 경쟁을 미국이 자체적인 안전 조치를 미루는 이유로 삼아서는 안 된다"며 "미국과 중국이 AI 안전 협약에 참여하고 서로의 안전 관리 방식을 배울 필요가 있다"고 밝혔다. 이번 발언은 미국에서 AI 개발 속도를 늦춰야 한다는 주장을 놓고 논쟁이 이어지는 가운데 나왔다. 도널드 트럼프 미국 대통령은 중국이 빠르게 추격하는 상황에서 미국이 AI 개발 속도를 늦춰서는 안 된다는 입장을 밝혀왔다. 술레이만 CEO는 AI 안전 규제가 반드시 기술 개발을 늦추는 것은 아니라고 주장했다. 규제를 안전을 높이기 위한 공통 규범과 기준을 마련하는 과정으로 규정하며 개발 속도와 안전장치를 함께 가져갈 수 있다고 설명했다. 미국과 중국 가운데 한쪽이 AI 경쟁에서 승리한다는 시각에도 거리를 뒀다. AI 기술이 빠르게 확산되고 오픈소스 모델도 뒤따르는 만큼 특정 국가나 기업이 기술을 독점하기 어려우며 여러 주체가 참여하는 생태계로 접근해야 한다고 주장했다. 중국과의 경쟁과 AI 안전도 분리해 접근해야 한다고 밝혔다. 중국 자동차에 충분한 안전장치가 없다고 해서 미국도 같은 기준을 적용할 이유는 없다는 비유를 들며 중국의 규제 수준과 관계없이 미국이 자체적인 AI 안전 기준을 마련해야 한다고 설명했다. 미국의 안전장치 마련과 함께 중국과 공통 기준을 논의할 필요성도 제기했다. 양국이 AI 안전 협약에 참여해 서로의 관리 경험과 우수 사례를 공유하자는 취지다. 술레이만 CEO는 중국의 AI 기술력도 높게 평가했다. 중국과의 경쟁을 이유로 안전 분야의 협력 가능성까지 닫기보다 서로 배울 부분을 찾고 AI를 둘러싼 적대적인 표현도 낮춰야 한다고 주장했다. 그는 "중국을 우리 스스로의 노력을 진전시키지 않는 핑계로 삼아서는 안 된다"며 "양국 간 적대적인 수사를 낮춰야 한다"고 말했다.

2026.09.21 10:27김동원 기자

트럼프 "'AI 군' 창설…인공지능 이름도 바꾸자"

도널드 트럼프 미국 대통령이 인공지능(AI) 산업을 지원할 'AI 군(포스)' 창설을 예고했다. AI 개발 속도를 늦추자는 목소리가 커지는 가운데 새로운 규제를 늘리기보다 산업 성장을 이어가겠다는 입장도 재확인했다. 19일(현지시간) 로이터와 테크크런치 등에 따르면 트럼프 대통령은 이날 자신의 소셜미디어 트루스소셜을 통해 AI 포스를 만들고 AI 정책을 담당할 새 고위 책임자(AI 차르)를 조만간 임명하겠다고 밝혔다. 다만 AI 포스가 구체적으로 어떤 역할을 맡을지는 공개하지 않았다. 트럼프 대통령은 AI 산업을 별도 규제로 통제하는 데도 부정적인 입장을 나타냈다. AI가 잘못 사용되거나 문제가 발생할 경우 기존 형사·민사 사법체계를 통해 대응할 수 있다며 산업의 성장을 방해하거나 억누르지 않겠다고 주장했다. 이번 발표는 미국에서 AI 개발 속도를 둘러싼 논쟁이 커지는 가운데 나왔다. 다리오 아모데이 앤트로픽 최고경영자(CEO)는 최근 AI 능력이 빠르게 향상되는 데 따른 위험을 줄이기 위해 개발 속도를 조절하는 방안을 제안했다. 샘 올트먼 오픈AI CEO와 일론 머스크도 이에 동의한다는 뜻을 나타냈다. 트럼프 대통령은 AI 개발 속도를 늦추는 데 반대해왔다. 그는 최근 AI 위험에 대한 우려가 과장됐다고 주장하며 미국이 개발 속도를 늦추면 중국과의 경쟁에서 불리해질 수 있다는 입장을 보여왔다. 미국과 중국은 AI를 경제와 군사 경쟁력을 좌우할 기술로 보고 있다. 트럼프 대통령과 시진핑 중국 국가주석은 다음 주 정상회담을 앞두고 있으며 미국 정부 관계자들은 중국과의 협의에서 AI 문제를 다룰 예정이라고 밝혔다. 트럼프 대통령은 AI라는 명칭 자체를 바꾸자는 제안도 내놨다. 인공지능이라는 표이 기술을 제대로 설명하지 못한다며 '우월 지능'과 '극한 지능', '최고 지능' 등을 새로운 이름으로 제시하고 트루스소셜에서 이용자 투표를 시작했다. 트럼프 대통령은 "우리는 어떤 방식으로도 이 놀라운 산업의 성장을 방해하거나 억누르지 않을 것"이라며 "오히려 이를 소중히 여기고 돕고 성장하는 과정을 지켜볼 것"이라고 말했다.

2026.09.20 09:42김동원 기자

  Prev 1 Next  

지금 뜨는 기사

이시각 헤드라인

韓 공략 시동 건 코어위브…데이터센터 협력·추론 사업 키운다

먹고 입고 쓰는 한글…유통업계, 한글날 제정 100주년 마케팅 활발

삼성·TSMC, 올 3분기도 파운드리 '희비교차'…점유율 격차 확대 전망

최태원 "호남 반도체 팹, 용인 3분의 2 규모 검토...속도감 있게 추진"

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.