[논문리뷰] Read It Back: Pretrained MLLMs Are Zero-Shot Reward Models for Text-to-Image Generation본 논문은 텍스트-이미지 생성(T2I) 모델의 강화학습(RL) 과정에서 효율적이고 신뢰성 높은 보상 모델을 설계하는 것이 어렵다는 점을 해결하고자 합니다 .#Review#SpectraReward#Self-SpectraReward#Text-to-Image Generation#Reinforcement Learning#MLLM#Prompt-Likelihood Reward#Unified Multimodal Models2026년 7월 14일댓글 수 로딩 중