[논문리뷰] Training Specialist Models without Reasoning Trajectories for Domain Expert DistillationLarge Language Models (LLMs)에서 Specialist Distillation은 teacher-generated reasoning trajectories를 통해 domain expertise를 student model로 효과적으로 transfer하는 중요한 방법론으로 인식되고 있습니다.#Review#Specialist Distillation#Reasoning Trajectories#QA-only Supervision#Latent Trajectory Distribution#Specialization-Generalization Trade-off#KL Divergence#Anchored Supervised Fine-Tuning#Layer-Selective Tuning2026년 9월 15일댓글 수 로딩 중