[논문리뷰] SAGE: Mitigating Long-Horizon Reasoning Biases via Topological GuidanceLLM의 Long-Horizon Reasoning은 sparse-reward regimes에서 여전히 핵심적인 도전 과제로 남아 있습니다.#Review#Long-Horizon Reasoning#LLMs#Sparse Rewards#Exploration Bias#Compounding Bias#Symbolic Closure Analysis (SCA)#SAGE#Topological Guidance2026년 9월 27일댓글 수 로딩 중