[논문리뷰] UrbanGround: From Local Perception to Spatial Agency in a Real-Scale City본 논문은 Multimodal Large Language Models (MLLMs) 에이전트가 고립된 장면 인식에는 능숙하지만, 복잡한 실세계 도시 환경에서 이동하며 지속적인 spatial agency를 발휘할 수 있는지에 대해 의문을 제기합니다.#Review#Multimodal Large Language Models#Spatial Agency#UrbanGround#Embodied Navigation#Geospatial Data#Closed-Loop Interaction#3D Sandbox2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Urban Socio-Semantic Segmentation with Vision-Language Reasoning본 논문은 위성 이미지에서 건물이나 수역과 같은 물리적 속성이 아닌, 학교나 공원과 같은 사회적으로 정의된 도시의 의미론적 개체 를 정확하게 분할하는 새로운 도전 과제인 도시 사회-의미론적 분할(Urban Socio-Semantic Segmentation)을 해결하는 것을 목표로 합니다.#Review#Urban Segmentation#Socio-Semantic#Vision-Language Models (VLMs)#Reinforcement Learning#Geospatial Data#Multi-modal Reasoning#SAM2026년 1월 15일댓글 수 로딩 중
[논문리뷰] RAISECity: A Multimodal Agent Framework for Reality-Aligned 3D World Generation at City-Scale본 연구는 도시 규모 3D 세계 생성에서 기존 방법론이 직면한 품질, 충실도 및 확장성 문제를 해결하는 것을 목표로 합니다.#Review#3D World Generation#City-Scale#Multimodal Agents#Reality Alignment#Urban Simulation#Foundation Models#Geospatial Data2025년 11월 26일댓글 수 로딩 중