[논문리뷰] AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report본 논문은 현대 게임 개발의 노동 집약적이고 시간 소모적인 파이프라인을 대체할 수 있는 실시간 상호작용형 가상 세계 생성 모델을 제안한다. 기존의 영상 생성 모델들은 긴 시간 동안 일관성(Consistency)을 유지하거나 사용자의 카메라 조작 및 행동 입력에 실시간으로 반응하는 데 한계를 가지고 있다.#Review#World Modeling#Interactive Generation#Video Diffusion Transformer#Long-Horizon#Autoregressive#Spatiotemporal Memory2026년 7월 21일댓글 수 로딩 중
[논문리뷰] RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation본 논문은 로봇 학습을 위한 대규모 데이터 수집이 물리적 teleoperation의 물리적 제약과 자원 한계로 인해 병목 현상을 겪고 있다는 문제를 해결하고자 합니다.#Review#Digital Teleoperation#World Model#Robotic Learning#Video Diffusion Transformer#Action-Conditioned Generation#Sim2Real Transfer#Imitation Learning2026년 7월 7일댓글 수 로딩 중
[논문리뷰] TrackCraft3R: Repurposing Video Diffusion Transformers for Dense 3D Tracking본 논문은 기존의 영상 기반 3D 추적 방식이 가진 한계를 극복하고, 사전 학습된 비디오 생성 모델의 풍부한 시공간적 지식을 활용하여 효율적인 dense 3D tracking 프레임워크를 구축하는 것을 목표로 합니다.#Review#Video Diffusion Transformer#Dense 3D Tracking#Dual-Latent Representation#Temporal RoPE Alignment#Reference-Anchored Tracking2026년 5월 13일댓글 수 로딩 중
[논문리뷰] YingVideo-MV: Music-Driven Multi-Stage Video Generation본 논문은 기존 오디오 기반 아바타 비디오 생성 모델에서 잘 다루어지지 않았던 음악 공연 비디오 생성 및 카메라 모션 제어의 한계를 극복하고자 합니다.#Review#Music-Driven Video Generation#Diffusion Models#Multi-Stage Framework#Camera Control#Lip-Sync#Temporal Coherence#Video Diffusion Transformer2025년 12월 2일댓글 수 로딩 중