[논문리뷰] When2Think: Learning Difficulty-Aware Length Control for Efficient Hybrid Reasoning Models본 논문은 대형 추론 모델(LRMs)에서 발생하는 인지적 불균형인 Overthinking과 Underthinking 문제를 해결하고자 합니다.#Review#Hybrid Reasoning#Instance-Adaptive Computation#Reinforcement Learning#Reasoning Depth Control#Efficiency Tax#Large Reasoning Models (LRMs)2026년 9월 17일댓글 수 로딩 중