[논문리뷰] UniMoMo: Expert Merging-Based MoE Acceleration for Large Recommendation Models본 논문은 대규모 추천 모델을 위한 Sparse MoE가 학습된 이후, 실제 배포 단계에서 요구되는 제한된 자원(Expert Budget)에 맞춰 체크포인트를 효율적으로 축소하는 문제인 Expert-budgeted deployment를 해결한다.#Review#Recommender Systems#Mixture of Experts#Model Compression#Expert Merging#Adaptive Routing2026년 8월 11일댓글 수 로딩 중