[논문리뷰] ForgeWM: Progressive Causal Training for Few-Step Action-Conditioned Video World Models본 논문은 대화형 비디오 월드 모델에서 실시간성을 확보하기 위해 요구되는 소수 단계(Few-step) 생성과 게임 제어 정확도 유지 사이의 기술적 난제를 해결하고자 한다.#Review#Video World Models#Few-Step Generation#Causal Training#Action-Conditioning#Distribution Matching#Replay-Time Refinement2026년 8월 20일댓글 수 로딩 중
[논문리뷰] Addressable Memory for Video World Models본 논문은 Autoregressive 비디오 세계 모델에서 긴 시간의 생성 과정 중 발생하는 visual persistence 저하 문제를 해결합니다.#Review#Video World Models#Addressable Memory#KV Cache Compression#RoPE#Temporal Coherence#Episodic Recall#WorldTrace2026년 8월 9일댓글 수 로딩 중
[논문리뷰] WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models본 논문은 Interactive Video World Models (IWMs)이 long-horizon planning 및 exploration에서 겪는 compounding errors 문제를 해결하고자 합니다.#Review#Video World Models#Reinforcement Learning#Long-Horizon Planning#Compounding Errors#Self-Verification#Cycle-Consistency#Reversible Actions#Composite Actions#CycleBench2026년 8월 5일댓글 수 로딩 중
[논문리뷰] HelloWorld: Enabling Socially Interactive Characters in Video World Models본 논문은 기존 video world models이 사용자-캐릭터 간의 Social Interaction 기능을 지원하지 않는다는 핵심적인 문제를 해결하고자 합니다.#Review#Video World Models#Social Interaction#Self-Distillation#Temporal Cross-Attention Mask#HelloWorldBench#Camera-Pose Conditioning#Generative AI2026년 8월 5일댓글 수 로딩 중
[논문리뷰] MiniWorld: Democratizing the Training of Video World Models from Scratch본 논문은 대규모 컴퓨팅 자원 없이도 스트리밍 비디오 월드 모델을 학습할 수 있는 투명하고 재현 가능한 베이스라인을 제공하는 것을 목표로 합니다.#Review#Video World Models#Streaming Inference#Diffusion Transformer#Flow Matching#Block-Causal Attention#Autoregressive Generation2026년 8월 4일댓글 수 로딩 중
[논문리뷰] ShadowDancer: Teaching Video World Models Any Action by Learning Unified Dynamics Representations from a Video and Its Shadow본 논문은 interactive video world models에서 보편적이면서도 정밀한 action 제어가 어렵다는 난제를 해결합니다.#Review#Video World Models#Shadow Learning#Cross-shadow Prediction#Latent Action Models#Interactive Generation#Dynamics Representation2026년 7월 30일댓글 수 로딩 중
[논문리뷰] MemLearner: Learning to Query Context memory for Video World Models본 논문은 Video World Models가 긴 시간의 생성 과정에서 장면의 일관성을 유지하지 못하는 메모리 부족 문제를 해결하고자 한다.#Review#Video World Models#Context Memory#Adaptive Query Tokens#Diffusion Transformer#Learnable Memory2026년 6월 30일댓글 수 로딩 중
[논문리뷰] MBench: A Comprehensive Benchmark on Memory Capability for Video World Models본 논문은 기존의 영상 생성 평가 벤치마크들이 영상 품질, 모션 일관성, 텍스트 정렬에만 집중할 뿐, 세계 모델의 핵심인 장기적 메모리(Long-term Memory) 능력을 과소평가하고 있다는 문제의식에서 출발한다 .#Review#Video World Models#Long-term Memory#Benchmark#Entity Consistency#Environment Consistency#Causal Consistency2026년 6월 14일댓글 수 로딩 중
[논문리뷰] Latent Spatial Memory for Video World Models본 논문은 기존 비디오 월드 모델이 가진 3D 공간 일관성 유지의 한계와 과도한 계산 비용 문제를 해결하기 위해 Mirage를 제안한다.#Review#Video Generation#Spatial Memory#3D-consistent Video Generation#Video World Models#Latent Space#Diffusion Models2026년 6월 8일댓글 수 로딩 중
[논문리뷰] StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement본 연구는 기존 Video World Models가 nominal한 미래 예측에만 의존하여, 로봇 정책의 실패 가능성이나 위험한 이벤트를 과소평가(under-explore)하는 문제를 해결하고자 합니다.#Review#Video World Models#Diffusion Models#Inference-time Steering#Robust Policy Evaluation#Typical Set#Vision-Language Models2026년 6월 1일댓글 수 로딩 중
[논문리뷰] minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models본 논문은 기존의 고품질 Video Foundation Model을 실시간 상호작용이 가능한 Interactive World Model로 전환하는 파이프라인의 부재 문제를 해결합니다.#Review#Video World Models#Diffusion Models#Autoregressive#Distillation#Real-time Inference#Camera Control2026년 5월 28일댓글 수 로딩 중
[논문리뷰] Quantitative Video World Model Evaluation for Geometric-Consistency본 연구는 현존하는 생성형 비디오 모델이 시각적으로는 고품질을 구현하지만, 엄격한 물리적 법칙을 따르는 3D 공간 이해도는 낮다는 점을 해결하고자 합니다.#Review#Video World Models#Geometric Consistency#PDI-Bench#3D Lifting#Perspective Distortion Index#Physical Realism2026년 5월 14일댓글 수 로딩 중
[논문리뷰] Out of Sight but Not Out of Mind: Hybrid Memory for Dynamic Video World ModelsVideo World Models는 물리적인 세계를 시뮬레이션하는 데 막대한 잠재력을 보여주지만, 기존 Memory Mechanism들은 환경을 주로 Static Canvas로 간주하는 한계를 가지고 있다.#Review#Video World Models#Hybrid Memory#Dynamic Retrieval Attention#HM-World Dataset#Spatiotemporal Consistency2026년 3월 29일댓글 수 로딩 중
[논문리뷰] WorldCache: Content-Aware Caching for Accelerated Video World ModelsDiffusion Transformers (DiTs) 기반의 비디오 World Model은 물리적으로 일관된 미래 visual state를 예측하는 데 필수적이지만, 순차적인 denoising 과정과 높은 계산 비용의 spatio-temporal attention으로 인해 상당한 계산 비용이 발생합니다.#Review#Diffusion Transformers#Video World Models#Feature Caching#Inference Acceleration#Content-Aware Caching#Motion-Adaptive Caching#Perception-Constrained Caching#Optimal Feature Approximation2026년 3월 23일댓글 수 로딩 중
[논문리뷰] Olaf-World: Orienting Latent Actions for Video World Modeling본 논문은 액션 레이블의 희소성으로 인해 액션-제어 가능한 월드 모델의 확장이 제한되는 문제를 해결하고자 합니다.#Review#Video World Models#Latent Actions#Cross-context Transfer#Zero-shot Action Transfer#Data-efficient Adaptation#Self-supervised Learning#Representation Alignment2026년 2월 10일댓글 수 로딩 중