[논문리뷰] EchoWM: Open and Enterable Omnimodal World Models본 논문은 기존의 생성형 모델들이 프롬프트 기반의 수동적인 방식에 머물러 있어, 사용자가 환경을 직접 탐험하고 상호작용하는 ‘Enterable’한 경험을 제공하지 못하는 문제를 해결하고자 합니다.#Review#World Models#Omnimodal Generation#Camera-Intent Conditioning#6-DoF Trajectory#Progressive Training#Audio-Visual Synchronization2026년 8월 24일댓글 수 로딩 중
[논문리뷰] DreamTraj: Generating 6-DoF Object Trajectories by Reading Unrendered Video Diffusion Latents본 논문은 단일 RGB 이미지와 텍스트 명령(instruction)만을 사용하여 물체의 미래 6-DoF 궤적을 예측하는 문제를 해결합니다.#Review#6-DoF Trajectory#Video Diffusion Models#Embodied AI#Implicit Motion Generation#Flow-Matching#Egocentric Manipulation2026년 8월 3일댓글 수 로딩 중
[논문리뷰] SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer본 논문은 1분 이상의 고해상도 영상을 생성할 때 발생하는 높은 컴퓨팅 비용과 긴 시간 동안의 시각적·기하학적 일관성 유지 문제를 해결하고자 한다. 기존의 월드 모델 연구들은 대규모 데이터와 컴퓨팅 자원을 요구하며, 다수의 GPU 환경이 필수적인 경우가 많아 학계나 일반 연구자들이 접근하기 어렵다는 한계가 있다.#Review#World Model#Diffusion Transformer#Long-context Modeling#Camera Control#6-DoF Trajectory#Efficiency#Video Generation2026년 5월 14일댓글 수 로딩 중