[논문리뷰] Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models본 논문은 Multimodal Large Language Models (MLLMs)에서 고해상도 이미지 및 비디오와 같은 긴 Visual Token 시퀀스로 인해 발생하는 막대한 계산 오버헤드 문제를 해결하고자 한다.#Review#Multimodal Large Language Models (MLLMs)#Visual Token#Low-Rank Adapters#Visual State Reconstruction#Efficiency#Inference#Supervised-KD2026년 9월 28일댓글 수 로딩 중