[논문리뷰] ReToken: One Token to Improve Vision-Language Models for Visual Retrieval본 논문은 긴 시각적 문맥(long visual context)을 처리해야 하는 VLM이 정보량이 많아짐에 따라 성능이 저하되는 문제를 해결하고자 한다.#Review#Vision-Language Models#Visual Retrieval#Long-Context Understanding#ReToken#Attention Mechanism#KV Cache#Sparse Retrieval2026년 7월 30일댓글 수 로딩 중
[논문리뷰] DecMem: Towards Minute-Long Consistent World Generation with Decoupled Memory본 논문은 장기 비디오 생성 시 발생하는 시간적 일관성 부족과 계산 효율성 문제를 해결하기 위해 DecMem을 제안한다.#Review#World Model#Video Generation#Long-horizon Extrapolation#Memory Architecture#Sparse Retrieval#Attention Dispersion2026년 5월 31일댓글 수 로딩 중