[논문리뷰] Why Do Video Diffusion Models Violate Physics? Unveiling the Flaws in Attention Mechanisms최신 비디오 확산 모델들은 인상적인 시각적 품질에도 불구하고, 실제 물리 법칙을 위반하는 콘텐츠를 자주 생성하여 물리적 상식(Physical Commonsense)의 부족을 드러냅니다.#Review#Video Diffusion Models#Physical Commonsense#Attention Mechanisms#Interpretability#Motion Planning#Rotary Position Embedding (RoPE)#Text-to-Video2026년 9월 21일댓글 수 로딩 중
[논문리뷰] Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving본 논문은 자율주행을 위한 통합 비전-언어 파운데이션 모델인 Qwen-Drive-1.0을 제안하여, 기존 모듈형 파이프라인의 한계를 극복하고자 한다.#Review#Vision-Language Foundation Model#Autonomous Driving#3D Perception#Motion Planning#Bird’s-Eye-View (BEV)#Visual Question Answering#Flow Matching2026년 9월 1일댓글 수 로딩 중
[논문리뷰] NaviDriveVLM: Decoupling High-Level Reasoning and Motion Planning for Autonomous Driving본 연구는 기존 VLM 기반 자율주행(AD) 시스템 이 직면한 고수준 추론 능력과 정밀한 모션 계획 사이의 트레이드오프 문제를 해결하고자 합니다.#Review#Autonomous Driving#Vision-Language Models#Motion Planning#High-Level Reasoning#Decoupled Architecture#Supervised Fine-tuning#NuScenes Benchmark2026년 3월 9일댓글 수 로딩 중
[논문리뷰] Planning with Sketch-Guided Verification for Physics-Aware Video Generation이 논문은 비디오 생성 모델이 복잡한 동작 명령을 따르고 물리적으로 사실적이며 시간적으로 일관된 시퀀스를 생성하는 데 어려움을 겪는 문제를 해결하는 것을 목표로 합니다.#Review#Video Generation#Motion Planning#Physics-Aware AI#Multimodal Verification#Diffusion Models#Test-Time Optimization#Sketch-Guided2025년 11월 23일댓글 수 로딩 중