[논문리뷰] UniSwap: Streaming Audio-Visual Identity Swapping for Talking Videos본 연구는 말하는 영상의 캐릭터 교체 작업에서 시각적 모습과 목소리를 동시에 일관성 있게 바꾸는 통합 시스템의 부재라는 문제를 해결하고자 합니다. 기존 방식들은 비디오 캐릭터 교체와 음성 변환 모델을 개별적으로 최적화하여, 결과물에서 입 모양과 음성 간의 오디오-비주얼 불일치가 발생하기 쉽습니다.#Review#Audio-Visual Generation#Identity Swapping#Streaming Diffusion#Diffusion Transformer#Distillation#Talking Video2026년 8월 13일댓글 수 로딩 중