[논문리뷰] From Corpora to Co-Evolving Capabilities: Capability-Centric Data Design for Generalist Image Generation본 논문은 일반적인(Generalist) 이미지 생성 모델을 위해 데이터 구축 방식을 '데이터셋 중심'에서 '생성 능력(Capability) 중심'으로 전환해야 함을 제안합니다.#Review#Generalist Image Generation#Data Engineering#Curriculum Learning#Capability-Centric Design#T2I (Text-to-Image)#Multimodal Diffusion Models2026년 8월 18일댓글 수 로딩 중
[논문리뷰] LaViDa-R1: Advancing Reasoning for Unified Multimodal Diffusion Language Models본 논문은 기존 확산 언어 모델(dLLMs) 기반 추론 시스템이 겪는 태스크 특이성, RL 학습 불안정성, 훈련 신호 부족 등의 문제를 해결하고자 합니다.#Review#Multimodal Diffusion Models#Reasoning#Reinforcement Learning#Supervised Finetuning#Visual Question Answering#Image Editing#Object Grounding#Policy Gradient2026년 2월 16일댓글 수 로딩 중