[논문리뷰] Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text본 논문은 기존 공간 인지 벤치마크가 텍스트 출력 VLM에 편향되어 있어, 이미지 생성 모델의 공간적 능력을 객관적으로 평가할 수 없는 인터페이스 불일치 문제를 해결하고자 한다 .#Review#Spatial Cognition#Generative Pixels#ProVisE#SpatialGen-Bench#VLM#Answer-Interface Mismatch#Benchmark-Agnostic Framework2026년 7월 23일댓글 수 로딩 중
[논문리뷰] V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models본 논문은 최신 생성 비디오 모델의 추론 능력을 체계적이고 신뢰할 수 있게 평가하기 위한 벤치마크 스위트인 V-ReasonBench 를 제안합니다.#Review#Video Generation#Reasoning Benchmark#Chain-of-Frame#Evaluation#Multimodal AI#Physical Dynamics#Spatial Cognition#Pattern Inference2025년 11월 20일댓글 수 로딩 중
[논문리뷰] From reactive to cognitive: brain-inspired spatial intelligence for embodied agents본 논문은 기존의 반응적(reactive) 접근 방식이 가진 공간 기억의 부재와 그로 인한 복잡한 실세계 환경에서의 일반화 및 적응성 부족 문제를 해결하는 것을 목표로 합니다.#Review#Spatial Cognition#Embodied Agents#Brain-inspired AI#Cognitive Map#Spatial Memory#MLLMs#Navigation2025년 9월 2일댓글 수 로딩 중