[논문리뷰] Knowing When Thinking Is Not Enough: Teaching Small Reasoning Models to Reason Beyond Their Parametric Knowledge본 논문은 테스트 타임 컴퓨테이션(test-time computation) 확장이 언어 모델 추론 성능 향상에 강력한 방법임에도 불구하고, 소형 추론 모델(sRMs)에서는 그 효과가 항상 충분하지 않다는 핵심 문제를 제기합니다.#Review#Small Reasoning Models#Knowledge Bottleneck#Execution Bottleneck#Selective Querying#Reinforcement Learning#Supervised Fine-tuning#Tool Use#Language Model Reasoning2026년 9월 28일댓글 수 로딩 중