[논문리뷰] EXIMO: VLM Guided Exploration of VLA Policies본 논문은 사전 학습된 VLA 정책을 새로운 long-horizon 과업에 대해 sample-efficient하게 파인튜닝하는 문제를 해결합니다.#Review#VLM#VLA#Robotic Manipulation#Reinforcement Learning#Sample Efficiency#Policy Finetuning#Distillation2026년 8월 20일댓글 수 로딩 중