[논문리뷰] ShotPlan: Cinematic Video Generation with Learnable Planning Token본 논문은 기존 비디오 생성 모델이 단일 샷(Single-shot) 생성에는 탁월하지만, 영화나 드라마와 같은 복잡한 내러티브를 위한 멀티 샷(Multi-shot) 생성에는 한계가 있다는 문제를 해결하고자 합니다.#Review#Video Generation#Diffusion Transformer#Learnable Planning Token#Cinematic Video#FRoPE#Multi-shot Generation#Temporal Control2026년 7월 20일댓글 수 로딩 중
[논문리뷰] Wan-S2V: Audio-Driven Cinematic Video Generation본 연구는 기존 오디오 기반 캐릭터 애니메이션 모델이 복잡한 영화 및 TV 프로덕션 시나리오(미묘한 상호작용, 현실적인 신체 움직임, 다이내믹한 카메라 워크)에서 한계를 보이는 문제를 해결합니다.#Review#Audio-Driven Video Generation#Cinematic Video#Diffusion Models#Transformer Architecture#Long Video Consistency#Human Animation#Multimodal Control#Data Curation2025년 8월 27일댓글 수 로딩 중