[논문리뷰] Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs본 논문은 최신 Vision-Language-Action(VLA) 모델들이 Chain-of-Thought(CoT) Supervision 과정에서 GT 궤적에 과도하게 의존하여 발생하는 인과적 불충실성(causal unfaithfulness) 문제를 해결하고자 합니다.#Review#Autonomous Driving#Vision-Language Models#Chain-of-Thought#Trajectory Anchoring Bias#Verifiable Reasoning#Reinforcement Learning2026년 8월 3일댓글 수 로딩 중
[논문리뷰] VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models본 논문은 3B 파라미터 규모의 소형 모델(SLM)이 대형 모델(LLM)의 전유물로 여겨지던 최전선 수준의 논리적 추론 능력을 달성할 수 있는지 검증하고자 한다.#Review#Small Language Models#Verifiable Reasoning#Reinforcement Learning#Parametric Compression-Coverage Hypothesis#Reasoning-Knowledge Decoupling#Test-time Scaling2026년 6월 15일댓글 수 로딩 중