AI HubAI Hub

WorldCrafter: 암묵적 3D 인지 메모리로 일관된 비디오 월드 모델 구현

arxiv·ai·2시간 전

핵심요약

• WorldCrafter는 카메라 시점에 따라 다중 시점 증거를 압축하는 3D 인지 암묵 메모리를 학습하는 비디오 월드 모델이다. • 메모리 인코더와 자세 조건화 모듈을 통해 명시적 깊이 정보 없이도 과거 관찰을 효과적으로 통합한다. • 단일 이미지나 텍스트 입력으로 장시간 탐색 시에도 시점 일관성과 시각 품질을 크게 향상시킨다.

💬 댓글 (0개)