[논문리뷰] SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem본 논문은 LVLM(Large Vision-Language Model)이 2D 이미지로부터 3D 구조를 추론하는 공간 지능이 부족하다는 점을 해결하고자 한다. 기존 연구들은 실제 장면(real-scene)에 대한 dense한 기하학적 주석(annotation)에 의존하여 확장성이 낮고 비용이 많이 드는 한계가 있다 .#Review#Spatial Intelligence#LVLM#Block-Stacking#Synthetic Dataset#Spatial Reasoning#Anchor-based Reasoning#Reinforcement Learning2026년 9월 10일댓글 수 로딩 중