#Data Mixture Optimization

2개의 포스트

[논문리뷰] Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training

Large Language Model (LLM) 사전 학습에서 효과적인 데이터 혼합 비율을 결정하는 것은 여전히 어려운 문제입니다.

#Review #LLM Pre-training #Data Mixture Optimization #Model Merging #Proxy Models #Resource Efficiency #DeMix #Corpus Curation

2026년 2월 3일

[논문리뷰] Learning to See Before Seeing: Demystifying LLM Visual Priors from Language Pre-training

본 논문은 텍스트 전용 사전 훈련을 통해 대규모 언어 모델(LLM)이 시각적 세계에 대해 습득하는 내재된 시각적 사전 지식(visual priors)의 구조와 기원 을 체계적으로 밝히는 것을 목표로 합니다.

#Review #LLM Visual Priors #Language Pre-training #Multimodal LLM #Data Mixture Optimization #Reasoning Prior #Perception Prior #VQA #MLE-Bench

2025년 10월 1일