[논문리뷰] Think Before You Score: Thinking Reward Model for Visual Generation본 논문은 시각적 생성 모델의 평가에서 나타나는 불투명성과 케이스별 요구 사항의 다양성을 해결하기 위해 제안되었습니다.#Review#Thinking Reward Model#Visual Generation#Pairwise Preference Optimization#PD-GRPO#Reinforcement Learning#Case-adaptive Rubrics2026년 9월 29일댓글 수 로딩 중