[논문리뷰] Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text본 논문은 기존 공간 인지 벤치마크가 텍스트 출력 VLM에 편향되어 있어, 이미지 생성 모델의 공간적 능력을 객관적으로 평가할 수 없는 인터페이스 불일치 문제를 해결하고자 한다 .#Review#Spatial Cognition#Generative Pixels#ProVisE#SpatialGen-Bench#VLM#Answer-Interface Mismatch#Benchmark-Agnostic Framework2026년 7월 23일댓글 수 로딩 중