[논문리뷰] HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness본 논문은 Training-based embodied navigation 방법론이 직면한 Generalization Challenge를 해결하고자 합니다. 기존 Training-based 방법들은 특정 태스크에 효과적이지만, 새로운 태스크나 환경으로 확장 시 추가 데이터와 Adaptation이 요구되는 한계가 있습니다.#Review#Embodied Navigation#Training-Free#Agent Harness#MLLMs#Spatiotemporal Graph#Hierarchical Event Memory#Zero-Shot#Instruction-Following#Object-Goal Navigation2026년 9월 15일댓글 수 로딩 중
[논문리뷰] LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation본 논문은 현대의 VLM이 이미 우수한 공간 추론 능력을 갖추고 있음에도 불구하고, 기존의 로봇 네비게이션 시스템은 여전히 태스크나 Embodiment별로 파편화된 구조를 가지고 있다는 문제에서 출발합니다 .#Review#Embodied Navigation#Vision-Language Models#Generalist Model#Spatial Intelligence#Residual Vector-Quantization#Dual-Channel Pointing#Embodied AI2026년 8월 31일댓글 수 로딩 중
[논문리뷰] UrbanGround: From Local Perception to Spatial Agency in a Real-Scale City본 논문은 Multimodal Large Language Models (MLLMs) 에이전트가 고립된 장면 인식에는 능숙하지만, 복잡한 실세계 도시 환경에서 이동하며 지속적인 spatial agency를 발휘할 수 있는지에 대해 의문을 제기합니다.#Review#Multimodal Large Language Models#Spatial Agency#UrbanGround#Embodied Navigation#Geospatial Data#Closed-Loop Interaction#3D Sandbox2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Embodied-Navigator: Point, Think, Memorize, and Align for Efficient Navigation본 논문은 VLM 기반 Embodied Navigation에서 발생하는 기하학적 불일치, 추론 효율성 저하, 장기 기억 관리의 한계 문제를 해결하기 위해 TAMP-Nav 프레임워크를 제안합니다.#Review#Embodied Navigation#VLM#Chain-of-Thought#Anchor-Trajectory Memory#GRPO#Pixel-to-3D#Spatio-Temporal Perception2026년 8월 18일댓글 수 로딩 중
[논문리뷰] Robostral Navigate본 논문은 기존 embodied navigation 시스템들이 고비용 센서(Depth, LiDAR 등)와 환경별 보정(Calibration)에 과도하게 의존하는 문제를 해결하고자 한다. 이러한 의존성은 다양한 하드웨어 및 환경으로의 확장성을 저해하며, 결과적으로 일반화 능력을 제한한다.#Review#Vision-Language Model#Embodied Navigation#Pointing-based Navigation#Prefix-Caching#Reinforcement Learning#Cross-Robot Generalization2026년 7월 23일댓글 수 로딩 중
[논문리뷰] Image2Sim: Scaling Embodied Navigation via Generative Neural Simulator본 논문은 Embodied Navigation 학습을 위한 대규모의 고품질 물리 기반 대화형 시뮬레이션 환경이 부족하다는 문제점을 해결하고자 합니다. 기존 연구들은 실제 스캔 데이터와 합성 데이터 사이의 trade-off, 즉 시각적 충실도와 확장성 사이의 한계에 직면해 있습니다 .#Review#Embodied Navigation#Neural Simulator#3D Gaussian Splatting#Pixel Flow#Vision-Language Navigation#Sim-to-Real2026년 7월 7일댓글 수 로딩 중
[논문리뷰] PlatonicNav: Unveiling Semantic Correspondence in Navigation with Platonic Topological Maps본 논문은 기존의 Embodied Navigation 연구들이 Vision-Language Navigation (VLN)과 Object Goal Navigation (ObjNav)을 분리된 문제로 다루며, 이들 사이의 연계를 위해 과도한 Cross-modal 학습이나 대규모 VLM 모델에 의존하고 있다는 점을 문제로 지적한다 .#Review#Embodied Navigation#Platonic Representation Hypothesis#Topological Map#Blind Matching#Zero-shot Navigation#Cross-modal Alignment2026년 6월 2일댓글 수 로딩 중
[논문리뷰] VLingNav: Embodied Navigation with Adaptive Reasoning and Visual-Assisted Linguistic Memory기존 Vision-Language-Action (VLA) 모델이 복잡하고 장기적인 내비게이션 태스크에서 부족했던 명시적 추론 능력 과 영구적인 기억 구조 의 부재를 해결하는 것을 목표로 합니다.#Review#Embodied Navigation#VLA Model#Adaptive Reasoning#Chain-of-Thought (CoT)#Linguistic Memory#Reinforcement Learning#Sim-to-Real Transfer#Multi-task Learning2026년 1월 13일댓글 수 로딩 중
[논문리뷰] MMGR: Multi-Modal Generative Reasoning본 논문은 대규모 텍스트-투-비디오 모델 평가의 한계, 특히 인지적 충실도를 넘어선 추론 능력 을 평가하는 문제를 해결하고자 합니다.#Review#Multi-Modal Generative Models#Reasoning Evaluation#World Models#Physical Commonsense#Abstract Reasoning#Embodied Navigation#VLM-based Evaluation#Temporal Consistency2025년 12월 16일댓글 수 로딩 중
[논문리뷰] NaviTrace: Evaluating Embodied Navigation of Vision-Language Models본 논문은 Vision-Language Models (VLMs)의 실제 환경 내 로봇 내비게이션 능력 을 평가하기 위한 새로운 벤치마크 NaviTrace를 제안합니다.#Review#Vision-Language Models#Embodied Navigation#VQA Benchmark#Robotic Navigation#Semantic-aware Score#Dynamic Time Warping#Real-world Scenarios2025년 11월 9일댓글 수 로딩 중