WorldClaw는 텍스트 프롬프트만으로 자유롭게 탐색 가능한 대규모 3D 오픈월드를 생성하는 완전 에이전틱 조대-정밀 프레임워크다. 계획 에이전트가 텍스트 프롬프트를 지역·지형·자산·재질·공간 관계로 구성된 명세로 변환하면, WorldClaw는 의미론적 레이아웃과 재사용 가능한 자산, 생성형·절차형 재질, 지역 인식 높이 필드로부터 전역적으로 일관된 지형 기반을 구축한다. 세부 표현이 필요한 지역에서는 지형 조건부 구성을 생성하고 편집 가능한 텍스처 메시를 재구성해 지형 위에 배치를 복원하며, 렌더 기반 에이전트가 지형·객체·외관·접촉을 추가로 다듬는다. 다양한 오픈월드 프롬프트 실험에서 일관된 공간 구조, 시각적으로 매력적인 지역 콘텐츠, 편집 가능한 개별 자산을 동시에 갖춘 대규모 장면을 생성하면서도 일관된 전역 지형 구조를 유지했다.
- •계획 에이전트가 텍스트를 지역·지형·자산·재질 명세로 변환
- •의미론적 레이아웃 기반으로 전역 일관성을 갖춘 지형 기반 구축
- •세부 지역은 지형 조건부 구성과 편집 가능한 텍스처 메시로 정교화
- •렌더 기반 에이전트가 지형·객체·외관·접촉을 반복적으로 정제
- •대규모 장면에서도 전역 지형 일관성과 개별 자산 편집 가능성 동시 확보
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
WorldClaw: Agentic 3D Open-World Generation at Scale
본문 미리보기
arXiv:2608.05248v1 Announce Type: new Abstract: Generating large-scale, freely explorable 3D worlds from open-ended text remains challenging because a system must jointly maintain global spatial coherence, rich local content, and explicit assets suitable for downstream editing and reuse. We present WorldClaw, a fully agentic, coarse-to-fine framework for open-world 3D scene generation. Planning agents translate a text prompt into a structured specification of regions, terrain, assets, materials
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:11AI 초안

