[논문리뷰] Scalable Visual Pretraining for Language Intelligence본 연구는 대규모 언어 모델이 문서의 시각적 요소를 평문으로 변환할 때 발생하는 정보 손실을 해결하기 위해 시각적 문서 자체를 직접 학습하는 VP를 제안한다.#Review#Visual Pretraining#Foundation Models#Multimodal Learning#Scientific Reasoning#Representation Alignment#Autoregressive Training2026년 7월 12일댓글 수 로딩 중