[논문리뷰] SpatialCLI: Learning to Reason With Spatial Tools, Then Without Them일반적인 Vision-Language Models(VLMs)는 전반적인 과업 수행에는 능숙하나, 공간적 관계나 미세한 시각적 세부 사항을 파악하는 능력은 부족하다는 근본적인 문제가 존재한다.#Review#Vision-Language Models#Spatial Reasoning#Tool-Augmented Agents#Capability Internalization#Embodied AI#Agentic Reinforcement Learning2026년 7월 30일댓글 수 로딩 중