[논문리뷰] Self-OPD: On-Policy Distillation for Flow Matching Models without Teacher본 논문은 기존의 Flow Matching 모델 정렬(alignment) 방식이 가진 높은 컴퓨팅 비용과 성능 한계를 해결하기 위해 Self-OPD를 제안합니다.#Review#Flow Matching#On-Policy Distillation#Teacher-Free Alignment#Multi-Objective Optimization#Self-Exploration#Reward-Level Fusion2026년 8월 27일댓글 수 로딩 중