[논문리뷰] SceneActBench: Can Agents Act on the 3D Scenes They See?본 논문은 VLM 에이전트가 3D 장면을 단순히 설명하는 단계를 넘어, 실제 3D 환경에서 다중 객체를 대상으로 동작을 수행할 수 있는지 검증하기 위한 SceneActBench를 제안한다.#Review#Vision-Language Model#3D Agent#Benchmarking#Executable 3D Action#Geometric Reasoning2026년 7월 26일댓글 수 로딩 중