[논문리뷰] ConsiSpace: Learning Geometric Consistency Matters for Video Spatial Reasoning본 논문은 기존 MLLM이 비디오 공간 추론(Video Spatial Reasoning)에서 겪는 비효율성과 뷰포인트 변화에 따른 추론 불안정성 문제를 해결하고자 합니다.#Review#Video Spatial Reasoning#Multimodal Large Language Models#Geometric Consistency#Memory-Augmented#Reinforcement Learning#Viewpoint Stability2026년 7월 21일댓글 수 로딩 중
[논문리뷰] EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies본 논문은 기존의 VLA 모델이 엄격한 Markovian 가정 하에 작동하여 장기 작업(long-horizon) 중 발생하는 시각 정보의 차단이나 일시적 변화를 적절히 처리하지 못하는 문제를 해결합니다.#Review#Vision-Language-Action Models#Robotic Manipulation#Long-Horizon#Memory-Augmented#Keyframe Evidence Memory#Non-Markovian2026년 6월 23일댓글 수 로딩 중