[논문리뷰] Long-Horizon Audio-Visual Generation for Persistent Stories and Interactive Worlds본 논문은 기존 비디오 생성 모델이 가진 고정된 시간적 윈도우의 한계를 극복하고, 장시간의 내러티브와 상호작용 가능한 세계를 일관되게 생성하기 위한 JoyAI-Echo-1.5를 제안합니다.#Review#Audio-Visual Generation#Long-Horizon#World Modeling#Memory Conditioning#Self-Gradient Forcing#Action Interface#6-DoF2026년 8월 26일댓글 수 로딩 중