페이페이 리가 이끄는 월드랩스가 텍스트·이미지·비디오·3D 데이터를 하나의 공간적 맥락으로 통합해 세계를 생성·재구성·시뮬레이션하는 차세대 옴니 월드 모델 '아틀라스'를 공개했다. 아틀라스는 단 한 장의 참조 이미지만으로도 입력에 없던 새로운 시점을 생성할 수 있으며, 사용자가 지정한 카메라 위치와 각도에 따라 픽셀 단위에 가까운 정밀한 카메라 제어가 가능하다. DTU·ETH3D·ScanNet 등 주요 3D 재구성 벤치마크에서 기존 오픈소스 모델들을 능가했으며, 카메라 경로 추종 성능에서도 제미나이 옴니 플래시와 미니맥스 H3 등 기존 상위권 영상 생성 모델을 앞섰다. 월드랩스는 아틀라스를 선택된 파트너 대상 얼리 액세스로 제공하며 향후 자사 제품 '마블'에도 적용해 창작·로봇·게임 등으로 확장할 계획이다.
- •월드랩스가 텍스트·이미지·비디오·3D를 통합 처리하는 옴니 월드 모델 '아틀라스'를 공개했다.
- •단 한 장의 참조 이미지로도 새로운 시점을 생성하는 신규 시점 합성 성능을 입증했다.
- •DTU·ETH3D·ScanNet 등 3D 재구성 벤치마크에서 기존 오픈소스 모델을 능가했다.
- •카메라 경로 추종 성능에서 제미나이 옴니 플래시, 미니맥스 H3 등을 앞섰다.
- •선택된 파트너 대상 얼리 액세스로 제공되며 향후 '마블' 등 자사 제품에 적용될 예정이다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
월드랩스, 옴니 월드모델 ‘아틀라스’ 공개...사진 한 장으로 3D 공간 추론
- 1.월드랩스, 텍스트·이미지·비디오·3D를 통합 처리하는 옴니 월드모델 '아틀라스' 공개
- 2.사진 한 장으로 새 시점 영상 생성, 픽셀 단위 카메라 제어와 최대 1440p·1분 영상 지원
- 3.DTU·ETH3D·ScanNet 3D 재구성 벤치마크에서 기존 오픈소스 능가, 카메라 경로 추종도 경쟁모델 상회
- 4.로봇 훈련용 Real-to-Sim 시뮬레이션과 '불릿타임' 촬영 효과 구현에도 활용, 파트너 얼리 액세스 제공
왜 중요한가?
희소한 참조 이미지만으로 공간을 일관되게 재구성·추론하는 능력은 오랜 3D 컴퓨터 비전 난제였던 '신규 시점 합성'을 진전시킨 것으로, 로봇·게임·VFX 등에서 실제 촬영 없이 대규모 학습·시뮬레이션 데이터를 만드는 새로운 방법을 제공한다.
언급 프로젝트
월드랩스가 공개한 '아틀라스'는 텍스트와 이미지, 3D 데이터를 통합해 실제 세계를 이해하고 시뮬레이션하는 차세대 월드 모델입니다. 이는 국내 메타버스, 디지털 트윈, 로봇 공학 등 공간 지능 AI 기반 산업에 혁신적인 발전을 가져올 잠재력이 크며, 관련 기술 경쟁의 새로운 전환점이 될 것입니다.
본문 미리보기
페이페이 리가 이끄는 AI 스타트업 월드랩스(World Labs)가 텍스트와 이미지, 비디오, 3D 데이터를 하나의 공간적 맥락으로 통합해 실제 세계를 생성·재구성·시뮬레이션할 수 있는 차세대 월드 모델을 공개했다. 단순한 영상 생성 모델을 넘어 공간 구조와 시간에 따른 변화를 함께 이해하고, 카메라 위치와 움직임까지 정밀하게 제어할 수 있다는 점에서 공간지능 AI 경쟁을 한 단계 끌어올렸다는 평가다.월드랩스는 1일(현지시간) 차세대 옴니(Omni) 월드 모델 ‘아틀라스(Atlas)’를 선보였다.아틀라스는 처음부터 텍스트·이미지·비
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
