[논문리뷰] See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models본 논문은 대규모 데이터셋을 활용하는 VLA 모델 학습 시, 카메라 뷰포인트 변화에 따른 성능 저하 문제를 해결하고자 합니다. 기존 모델들은 카메라 프레임의 RGB 데이터를 입력으로 사용하므로, 실제 로봇 동작이 정의되는 Robot-frame과의 Frame mismatch가 발생합니다 .#Review#VLA#Manipulation#3D Geometry#Pointmap#Robot-Centric#Viewpoint Variation#End-to-End Learning2026년 7월 19일댓글 수 로딩 중