[논문리뷰] AV-GRPO: Modality-Anchored Decoupling Diffusion Reinforcement Learning for Joint Audio-Video Generation본 논문은 기존 Joint Audio-Video Generation 모델들이 Per-modality Fidelity 부족, Text-Modality Alignment 미흡, 그리고 Cross-Modal Synchronization의 약점이라는 문제점을 겪고 있음을 지적한다.#Review#Joint Audio-Video Generation#Reinforcement Learning#Diffusion Models#Policy Optimization#Cross-Modal Synchronization#Modality-Anchored Learning#Credit Assignment#Multimodal Generative Models2026년 9월 24일댓글 수 로딩 중