[논문리뷰] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video본 논문은 uncalibrated monocular video로부터 reconstruction-grade의 4D human avatar를 재구성하는 난제를 해결하기 위해 제안되었습니다.#Review#Multiview Video Generation#4D Human Reconstruction#4D Gaussian Splatting#Reference Context Packing#Target Context Routing#3D-Aware Skeleton Conditioning2026년 8월 20일댓글 수 로딩 중
[논문리뷰] Action Images: End-to-End Policy Learning via Multiview Video Generation본 논문은 7-DoF 로봇 제어 입력을 Action Images로 변환하여 시각적 표현으로 통합하는 방식을 취합니다 . 제안 모델은 Wan 2.2 비디오 백본을 기반으로 하며, RGB 비디오와 Action Images를 결합하여 비디오 공간에서 물리적 동역학을 모델링합니다 .#Review#World Action Model#Robot Policy Learning#Multiview Video Generation#Pixel-grounded Representation#Zero-shot Policy2026년 4월 7일댓글 수 로딩 중