[논문리뷰] WanSong v1.0 Technical Report본 논문은 기존의 Autoregressive(AR) 기반 오디오 생성 모델이 가진 낮은 효율성과 장기 오디오 생성 시의 일관성 유지 문제를 해결하기 위해 고안되었습니다. 기존 연구들은 다단계(Cascaded) 파이프라인이나 AR 모델을 주로 채택하여 복잡성이 높고 효율성이 떨어지는 한계가 있습니다.#Review#Diffusion-based Model#Music Generation#Dual-stem Modeling#Hybrid-MMDit#Reinforcement Learning#Foundation Model2026년 7월 16일댓글 수 로딩 중