[논문리뷰] DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution기존 비디오 생성 모델들은 시각적 충실도와 모션 품질에서 상당한 발전을 이루었지만, 오디오를 생략하거나 별도의 단계에서 합성하는 경우가 많아 시각적 역동성과 음향 이벤트 간의 상호 모델링이 제한적이라는 핵심적인 문제에 직면해 있다.#Review#Native Audio-Video Generation#Gated Cross-Modal Attention#Reinforcement Learning#2K Refinement#Open-Weight Model#Multimodal Feedback2026년 8월 31일댓글 수 로딩 중