• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'딥마인드'통합검색 결과 입니다. (67건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

구글 딥마인드, 생성형 AI에 손·발 달았다…로보틱스 SW 공개

구글 딥마인드가 인공지능(AI)이 현실 세계에서 사람처럼 추론·행동할 수 있게 돕는 로보틱스 모델을 발표했다. 구글 딥마인드는 차세대 AI 로봇 개발을 위한 '제미나이 로보틱스'와 '제미나이 로보틱스-ER'을 공개했다고 13일 공식 블로그를 통해 밝혔다. 해당 모델은 '제미나이 2.0' 기반으로 작동한다. 제미나이 로보틱스는 비전-언어-행동(VLA) 모델이다. AI가 눈으로 보고, 언어를 이해하고, 행동으로 옮길 수 있도록 설계된 모델이다. 단순히 텍스트나 이미지로만 정보를 처리하는 것이 아니라 직접 로봇을 제어해 움직이게 만드는 기능까지 갖췄다. 제미나이 로보틱스는 로봇 플랫폼에 적용 가능하도록 설계됐다. 현재 '알로하 2' 쌍팔 로봇 플랫폼 데이터로 훈련된 상태다. 학술 연구실에서 사용하는 프랑카 기반 로봇 제어도 가능하다. 특히 앱트로닉과 협력해 휴머노이드 로봇 '아폴로' 개발도 착수했다. 딥마인드는 "제미나이 로보틱스는 인간처럼 일반성과 상호작용성, 기민성을 갖췄다"며 "이전에 경험하지 못한 작업과 환경에서도 스스로 적응해 문제를 해결할 수 있으며, 다양한 자연어 명령을 이해하고 이에 따라 행동을 조정한다"고 강조했다. 또 "정교한 조작 능력으로 복잡한 다단계 작업도 처리할 수 있다"고 덧붙였다. 제미나이 로보틱스-ER은 제미나이 로보틱스 기능에 공간 이해력을 강화한 모델이다. 로봇이 주변 환경을 더 잘 이해하고 어떻게 움직여야 안전하고 효율적으로 작업을 할 수 있을지 스스로 판단할 수 있게 설계됐다. 이를 통해 인식과 상태 추정, 공간 이해, 계획 수립, 코드 생성까지 한 번에 처리할 수 있다. 복잡한 물체를 인식해 적절한 조작 방법을 제시도 가능하다. 소수 인간 시범만으로도 해결책을 도출할 수 있다. 엔드투엔드 테스트에서 기존 모델 대비 2~3배 높은 성공률을 기록했다. 딥마인드는 "AI가 현실 세계에서 실질적인 도움을 주기 위해서는 체화된 추론 능력과 정교한 행동 제어가 필수"라며 "앞으로도 다양한 테스트와 협력을 통해 AI 로봇의 현실 적용성을 확대해 나갈 것"이라고 밝혔다.

2025.03.13 10:43김미정 기자

"AI 영상 생성, 1시간에 250만원"…구글, '비오 2' 초고품질 전략 성공할까

인공지능(AI) 기반 비디오 생성 시장의 경쟁이 본격화되는 가운데 구글이 자사 영상 AI인 '비오 2'의 가격을 공개했다. 4K 초고품질 영상을 지원하나, 오픈AI의 '소라'보다 가격이 높아 비용 대비 경쟁력이 있을지에 대한 의문이 제기되고 있다. 두 모델 모두 환각 및 물리 법칙 구현 등 기술적 한계를 드러내고 있다는 점도 해결 과제다. 24일 테크크런치에 따르면 구글은 AI 비디오 생성 모델 '비오 2'의 가격을 초당 50센트(한화 약 700원)로 책정했다. 이는 시간당 1천800달러(한화 약 250만원), 분당 30달러(한화 약 4만2천원)에 해당하는 수준으로, 구글은 '비오 2'를 통해 고품질 영상 시장을 공략하며 영상 생성의 상업적 활용도를 높이려는 전략을 펼치고 있다. '비오 2'는 최대 4K 해상도를 지원하는 고급형 비디오 생성 모델이다. 구글 클라우드의 '버텍스 AI(Vertex AI)' 플랫폼을 통해 제공되며 고해상도와 정밀한 디테일을 구현하는 데 초점을 맞췄다. 다만 비용이 초당 50센트로 책정되면서 일반 사용자보다는 전문가 및 기업 시장을 겨냥한 서비스로 보인다. 특히 오픈AI의 비디오 생성 AI인 '소라'와의 가격 정책 차이가 주목된다. 오픈AI는 크레딧 기반의 구독 모델을 통해 '소라'를 운영하고 있으며 1천80p 기준 초당 20센트(한화 약 280원)로 '비오 2'보다 상대적으로 저렴한 가격을 제시하고 있다. 오픈AI의 비디오 AI 가격 구조는 이용자의 구독 플랜에 따라 달라지며 저해상도에서는 보다 낮은 비용으로 비디오를 생성할 수 있다. 현재 '소라'는 월 20달러(한화 약 2만8천원)의 챗GPT '플러스'와 월 200달러(한화 약 28만원)의 '프로' 플랜을 통해 제공되며 각각 1천 크레딧과 1만 크레딧을 지급하는 방식이다. 480p 해상도의 경우 초당 4크레딧으로 약 8센트(한화 약 110원), 1천80p 해상도에서는 초당 100크레딧으로 약 20센트(한화 약 280원)이 소모된다. '소라'는 현재 4K 해상도를 지원하지 않지만 비용 효율성 면에서는 '비오 2'보다 경쟁력이 높은 것으로 보인다. 다만 실제 영상 제작 현장에서는 두 모델 모두 완벽하지 않다는 지적이 나온다. 최근 업계 평가에 따르면 '비오 2'는 손가락, 눈동자, 피부 질감 등 세부 표현에서 비현실적인 결과가 발생하며 물리 법칙에 부합하지 않는 액체 유동성 표현 등의 문제가 드러난다. 또 '소라'는 인체 움직임에서 부자연스러운 관절 회전과 신체 비율 왜곡 현상이 잦으며 보행 시 다리 움직임이 로봇처럼 경직되는 문제를 보인다. 이 외에도 장면 전환 시 객체의 색상 및 크기 변화가 불안정해 시간적 일관성을 유지하는 데 어려움을 겪고 있다. 이 같은 기술적 한계는 두 모델이 아직 실제 영상 수준에 미치지 못하는 부분을 여실히 보여준다. 전문가들은 물리 엔진 통합 등 추가 개발이 필요하다고 지적하며 특히 의류 주름 시뮬레이션과 액체-고체 상호작용 구현이 시급한 과제라고 평가한다. 향후 개선된 기술이 도입될 경우 보다 현실적인 AI 영상 제작이 가능할 것으로 기대된다. 디나 베라다 유튜브 제품 담당 이사는 "'비오 2'는 현실 세계의 물리 법칙과 인간의 움직임을 더 잘 이해해 세밀하고 현실적인 결과물을 만든다"며 "스타일, 렌즈, 시네마틱 효과까지 지정할 수 있어 쉽고 재미있게 영상을 표현한다"고 강조했다.

2025.02.24 10:55조이환 기자

구글 딥마인드 "딥시크, 기존 AI 섞은 모델일 뿐"

데미스 하사비스 구글 딥마인드 공동 창업자 겸 최고경영자(CEO)가 중국 인공지능(AI) 기업 딥시크 모델이 우수하지만 기술적 혁신은 부족하다고 평가했다. 10일 테크크런치 등 외신에 따르면 하사비스 CEO는 프랑스 파리에서 열린 AI 액션 서밋에 앞서 '딥시크-R1'에 대해 이같이 언급했다. 그는 "딥시크는 분명히 우수한 결과물이지만 과학적으로 혁신을 보여준 것은 아니다"고 지적했다. 이어 "기존 AI 기술을 융합한 모델에 불과하다"고 덧붙였다. 하사비스 CEO는 딥시크 모델에 대해 “지정학적 측면에서 중요한 영향을 미칠 수 있다”고 평가하면서도, “기존에 알려진 AI 기술을 활용한 모델에 불과하다”고 덧붙였다. 딥시크는 지난해 12월 딥시크-V3(DeepSeek-V3) 출시 후 올해 초 딥시크-R1(DeepSeek-R1), 딥시크-R1-제로(DeepSeek-R1-Zero), 딥시크-R1-디스틸(DeepSeek-R1-Distill) 모델을 공개했다. 비전 기반 야누스-프로 7B(Janus-Pro 7B) 모델도 추가 공개했다. 딥시크는 해당 모델들이 기존 대비 90~95% 비용 절감과 비용 효율성을 제공하며, 강화 학습 기법을 적용해 우수한 추론 능력을 갖췄다고 주장하고 있다. 특히 저사양 칩으로도 오픈AI의 GPT-o1 수준 성과를 냈다고 밝히기도 했다. 이후 업계에서 AI 인프라 구축 비용 적절성에 대한 논의가 이어졌다. 엔비디아 등 주요 AI 기업 주가 하락이 이어지기도 했다. 이에 하사비스 CEO는 딥시크의 저비용 모델 주장에 대해 "실제 개발 비용이 공개된 수치보다 높을 수 있다"고 지적했다. 그는 이날 일반인공지능(AGI) 전망에 대한 의견도 밝혔다. 그는 AGI를 인간의 모든 인지 능력을 가진 프로그램이라고 정의했다. 이어 향후 5년 내 AGI 시스템이 등장할 가능성이 크다고 전마했다. 그러면서 "AGI는 사회 전반에 큰 변화를 가져올 것"이라며 "사회가 이에 대비하고, AI 기술 혜택이 모든 사람에게 돌아가게 만들어야 한다"고 당부했다.

2025.02.10 15:32김미정 기자

구글, '제미나이 2.0' 출시…생성형 AI 시장 재편 나선다

구글이 '제미나이'의 차세대 인공지능(AI) 모델을 다수 공개하며 기술 주도권 확보에 나섰다. 특히 추론 및 경량 모델의 공개는 중국 AI 스타트업 딥시크와의 경쟁에서 우위를 점하려는 전략으로 해석된다. 6일 테크크런치 등 외신에 따르면 구글이 '제미나이 2.0 프로 익스페리멘털(Gemini 2.0 Pro Experimental)'을 포함한 다수의 신형 AI 모델을 공개했다. 이번 발표에는 AI 추론을 위한 '제미나이 2.0 플래시 씽킹(Gemini 2.0 Flash Thinking)'과 비용 효율성을 높인 '제미나이 2.0 플래시 라이트(Gemini 2.0 Flash-Lite)'도 포함됐다. '제미나이 2.0 프로'는 구글이 지난해 2월 선보인 '제미나이 1.5 프로(Gemini 1.5 Pro)'의 후속 모델이다. 구글에 따르면 이번 모델은 자사의 AI 모델군에서 가장 뛰어난 성능을 갖췄다. 특히 코드 실행 및 복잡한 명령어 처리에서 우수한 성능을 발휘하며 보다 정교한 AI 추론과 지식 이해가 가능해졌다. 이 모델은 최대 200만 토큰의 컨텍스트 창을 제공한다. 이는 약 150만 단어를 한 번에 처리할 수 있는 수준으로, 해리 포터 시리즈 7권 전체를 한 번에 분석하고도 40만 단어 이상의 여유가 남는다. 또 사용자의 명령에 따라 구글 검색과 같은 외부 도구를 활용하고, 코드 실행을 자동화하는 기능도 포함됐다. 구글은 '제미나이 2.0 플래시 씽킹' 모델도 정식 출시했다. 이는 지난해 12월 발표된 AI 추론 모델로, 이번에 일반 사용자가 제미나이 앱에서 직접 이용할 수 있도록 했다. 이를 통해 AI의 논리적 사고와 문제 해결 능력을 향상시킬 수 있을 것으로 기대된다. 또 AI 비용 절감과 접근성을 높이기 위한 '제미나이 2.0 플래시 라이트'도 공개됐다. 기존 '제미나이 1.5 플래시(Gemini 1.5 Flash)' 대비 성능을 개선하면서도 동일한 가격과 속도로 운영되도록 설계됐다. 이는 최근 AI 비용 절감을 요구하는 시장의 요구에 대응하기 위한 조치로 보인다. 테크크런치는 "구글의 이번 발표는 중국 AI 스타트업 딥시크와의 경쟁이 본격화되는 상황에서 나왔다"며 "딥시크는 지난해 12월 AI 추론 모델 'R1'을 공개하며 저렴한 접근성과 글로벌 AI 기업에 대등한 성능으로 시장의 주목을 받은 바 있다"고 설명했다.

2025.02.06 09:12조이환 기자

구글 딥마인드 "올해 말 AI 신약 개발·임상실험 목표"

구글이 올해 말 인공지능(AI)으로 신약을 개발해 임상 실험할 계획이다. 23일 파이낸셜타임스(FT) 등 외신에 따르면 데미스 하사비스 구글 딥마인드 공동창업자 겸 최고경영자(CEO)는 알파벳의 신약 개발 스타트업 아이소모픽랩스가 올해 말까지 이같은 목표를 세웠다고 밝혔다. 하사비스 CEO는 "아이소모픽랩스는 현재 종양학을 비롯한 심혈관, 신경퇴행 등 모든 주요 질병 분야를 다루고 있다"며 "올해 말 첫 번째 신약을 갖게 될 것"이라고 내다봤다. 그는 "보통 신약 하나 만들려면 평균적으로 5~10년이 걸린다"며 "AI를 통해 이를 10배나 더 빠르게 단축할 수 있다면, 엄청난 혁명이 될 것"이라고 예측했다. 아이소모픽랩스는 2021년까지 딥마인드 소속에서 분사됐다. 현재 구글 모회사 알파벳 자회사로 남아 있다. 현재 AI로 신약 개발 소요 시간·비용을 낮추는 작업을 진행하고 있다. 또 하사비스 CEO는 구글의 AI 어시스턴트 프로토타입인 '프로젝트 아스트라(Project Astra)'가 올해 말 출시될 가능성이 높다고 말했다. 그는 "앞으로 3년 안에 수십억 개의 AI 에이전트들이 서로 결합해 작동할 것"이라고 덧붙였다. 이 외에도 그는 일반인공지능(AGI) 시대에 대한 견해도 밝혔다. 그는 "진정한 AGI를 위해선 아직 5~10년이 더 필요하다"고 강조했다. 또 AGI 시대가 오기 전 주요 AI 개발자들 사이에서 더 많은 신중함과 협력이 필요하다고 주장했다. 그는 "경쟁적으로 AGI를 개발해선 안 된다"며 "기술이 부정적으로 활용될 경우 인류 문명 자체를 위협할 수 있기 때문"이라고 설명했다.

2025.01.23 08:57김미정 기자

"수명 연장 목표"…오픈AI, 단백질 구조 재설계 돕는 AI 모델 개발

오픈AI가 단백질 구조 재설계를 돕는 인공지능(AI) 모델을 개발했다. 19일 MIT테크놀로지 리뷰는 오픈AI가 'GPT-4b 마이크로'를 만들어 내부적으로 실험 중이라고 이같이 보도했다. GPT-4b 마이크로는 단백질 재설계에 특화된 모델이다. 기존 단백질 설계도를 분석해 더 효율적인 설계법을 텍스트로 제안하는 식이다. 단백질이 체내에서 더 효율성 있게 기능하도록 돕는 목표로 개발됐다. 이 모델은 인간뿐 아니라 다양한 종에서 얻은 단백질 서열 예시를 학습했다. 어떤 단백질끼리 결합해야 시너지 효과를 얻을 수 있는지에 대한 정보로도 훈련받았다. GPT-4b 마이크로는 구글 딥마인드의 알파폴드와 다르다. 일반적으로 알파폴드는 단백질 구조를 3D로 예측해서 시각적으로 보여준다. 단백질이 어떻게 접히고, 어떤 모양인지 미리 알려주는 식이다. 이를 통해 연구자는 해당 단백질이 몸속에서 어떤 역할을 할지 이해할 수 있다. 반면 GPT-4b 마이크로는 단백질 재설계법을 제안하는 모델이다. 기존 단백질 아미노산 서열법 수정법도 알려준다. 이를 통해 단백질이 체내에서 더 효율적으로 작동하거나 특정 기능을 강화하도록 돕는 식이다. 이번 모델 개발은 1년 전 미국 샌프란시스코에 본사를 둔 레트로 바이오사이언스가 오픈AI와 단백질 엔지니어링 협업을 추진하면서 시작된 것으로 전해졌다. 앞서 2023년 샘 알트먼 오픈AI 최고경영자(CEO)는 레트로 바이오사이언스에 1억8천만 달러(약 2천700억원)를 개인 자금으로 투자했다. 레트로 바이오사이언스는 인간 평균 수명을 10년 연장하는 것을 목표로 둔 기업이다. 이를 위해 단백질 세트 '야마나카 인자'를 연구해 왔다. 야마나카 인자가 인간 피부 세포에 들어가면, 피부 세포는 젊은 줄기세포로 변화할 수 있다. 이를 통해 단순 수명 연장뿐 아니라 장기 제작, 대체 세포 공급원 마련을 구현할 계획이었다. 당시 야마나카 인자가 효율성이 낮다는 지적이 이어졌다. 이를 인간 피부 세포에 투입해도 젊은 줄기세포 생성이 원활하지 않았기 때문이다. 이에 레트로 바이오사이언스는 오픈AI와 협력해 'GPT-4b 마이크로' 개발에 착수한 것이다. 오픈AI 존 홀먼, 애런 재이크 연구원과 레트로 바이오사이언스 리코 마인틀 연구원이 협력해 모델을 만들었다. 양사 연구원들은 GPT-4b 마이크로 개발 후 진행한 실험 결과도 공개했다. 모델이 제안한 방법으로 야마나카 인자 설계법을 수정했다. 실험 결과 기존보다 최소 50배 넘는 효능 증가를 보였다고 발표했다. 당시 실험을 진행한 존 홀먼 연구원은 "전반적으로 과학자들이 직접 만들어낸 것보다 더 나은 단백질이 나왔다"며 "실험 결과를 논문으로 발표할 계획"이라고 밝혔다. GPT-4b 마이크로가 실제 의학에 활용될지는 미지수다. 해당 모델이 맞춤형 시연 버전에 가깝고 공식적인 출시도 미정이라서다. 외부 과학자들이 모델 기능을 평가한 사례도 없다. 재이크 연구원은 "이번 프로젝트는 기업들이 과학에 진심으로 기여한다는 것을 보여주기 위함"이라며 "해당 기능이 별도 모델로 공개될지, GPT 제품군에 통합될지는 미정"이라고 말했다.

2025.01.19 17:00김미정 기자

"현실과 똑같은 가상 구현"…구글, '월드 모델' 개발 착수

구글이 현실을 가상 세계에서 예측·시뮬레이션 할 수 있는 인공지능(AI) 모델 개발팀을 꾸렸다. 7일 테크크런치 등 외신에 따르면 구글은 이같은 '월드 모델' 개발에 나섰다. 구글 딥마인드에서 해당 업무를 맡았으며 브룩스 연구원이 팀을 이끌 예정이다. 브룩스는 지난해 10월 오픈AI에서 비디오 생성기 '소라' 개발에 참여했다. 해당 팀은 구글의 제미나이와 비오, 지니 개발 연구 바탕으로 꾸려진다. 제미나이는 구글의 대표 멀티모달 모델이며 비오는 비디오 생성 모델이다. 지니는 게임·3D 환경을 실시간 시뮬레이션할 수 있는 모델로 현실을 3D 세계에 구현할 수 있는 기능을 갖췄다. 구글은 이 모델들을 통합해 기존보다 한 단계 업그레이드한 월드 모델을 구축할 목표다. 월드 모델은 물리·가상 세계의 구조, 동작, 규칙을 학습하고 이를 기반으로 시뮬레이션할 수 있도록 설계된 AI 모델이다. 해당 모델은 환경을 이해하고 그 안에서 일어날 수 있는 상황을 예측하거나 생성할 수 있다. 스타트업과 다른 빅테크도 월드 모델 개발에 뛰어든 바 있다. 페이페이 리 스탠포드대학교 교수는 월드랩스를 설립해 해당 모델 개발에 착수했다. 이스라엘 스타트업 데카르드, 오디세이도 해당 모델을 개발 중이다. 리 교수는 "월드 모델은 AI 능력을 언어 중심적 이해를 넘어 자연과 물리 세계, 우주까지 영역을 확장할 수 있을 것"이라며 "증강현실(AR)·가상현실(VR) 기술 발전에 기여할 수 있을 것"이라고 자신했다. 다만 일반 멀티모달보다 데이터 학습·훈련에 드는 시간이 상당해 구체적 출시 시기는 미정이다. 저작권 문제도 여전히 해결되지 않았다. 테크크런치는 "다수 월드 모델은 비디오 게임 영상 기반으로 훈련됐다"며 "이런 비디오가 허가 없이 사용되면 모델을 개발한 기업이 소송 대상이 될 수 있다"고 분석했다.

2025.01.07 09:41김미정 기자

  Prev 1 2 3 4 Next  

지금 뜨는 기사

이시각 헤드라인

미·중 AI 협력 논의 직후…미 의회, 중국산 부품 차단 추진

NASA 로버, 화성 분화구서 고대 지하수 흔적 발견 [우주로 간다]

가트너 "2029년까지 VM웨어 고객 55% 이전 고려"...대체 인프라 검토

배터리도 반도체처럼…설계 따로 생산 따로 시대 오나

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.