[논문리뷰] Act with Intent: Distilling Behavior Intent for Vision-Language-Action Models본 논문은 Vision-Language-Action (VLA) 모델의 액션 디코더가 단순히 행동을 모방하는 것을 넘어, 해당 행동이 달성하고자 하는 behavior-level intent를 명시적으로 모델링해야 한다고 주장합니다.#Review#Vision-Language-Action Models#Intention Distillation#Behavioral Intent#Robot Manipulation#Semantic Supervision#Flow Matching#Policy Learning#Multimodal AI2026년 8월 30일댓글 수 로딩 중