[논문리뷰] Revisiting Complete Reasoning Traces for Post-Training본 연구는 LLM의 post-training 과정에서 필수적인 것으로 간주되던 긴 reasoning trajectory가 실제로는 많은 중복 정보를 포함하고 있어 효율성이 떨어진다는 문제점을 해결하고자 합니다.#Review#Reasoning Trajectories#Post-Training#Supervised Fine-Tuning (SFT)#Reasoning Redundancy#Endpoint-based SFT (E-SFT)#Chain-of-Thought (CoT)2026년 9월 9일댓글 수 로딩 중