[논문리뷰] How Does Reasoning Flow? Tracing Attention-Induced Information Flow for Targeted RL in LLMsLLM의 추론 과정은 내부적인 Information Flow가 불투명한 'Black Box' 형태로 작동하여 모델이 왜 특정 추론 결과를 도출하는지 설명하기 어렵다는 문제를 해결하고자 합니다.#Review#Large Language Models#Reasoning Process#Attention Mechanism#Information Flow#Reinforcement Learning2026년 6월 9일댓글 수 로딩 중