[논문리뷰] ShallowStream: Index Shallow then Answer Deep for Streaming Video Understanding본 논문은 실시간 영상 스트리밍 환경에서 MLLM이 겪는 과도한 연산 비용과 효율성 저하 문제를 해결합니다. 기존의 많은 연구는 모든 프레임을 모델의 전체 레이어(Full-depth)로 미리 처리(Prefill)하여 KV Cache를 생성하는데, 이는 매우 비용이 많이 들고 불필요한 연산을 유발합니다 .#Review#Streaming Video Understanding#MLLM#KV Cache#Efficient Inference#Query-Agnostic#Selective Retrieval2026년 9월 6일댓글 수 로딩 중