[논문리뷰] UniSpace: Unified Visual Representation and Scalable Multimodal Modeling본 논문은 기존 Multimodal Model이 이해와 생성을 위해 분리된 시각적 표현 공간(주로 Semantic Encoder와 VAE Latent)을 사용하는 문제를 해결하고자 한다 .#Review#Multimodal Modeling#Patch Reparameterization#Unified Visual Representation#Flow Matching#Vision Transformer#Image Generation#Image Editing2026년 8월 23일댓글 수 로딩 중