[논문리뷰] Debias-SparseGPT: Bias-Aware Pruning for Large Language Models본 연구는 LLM 압축 기술인 Pruning이 모델의 연산 효율성을 높이지만, 이 과정에서 모델 내부에 존재하는 인구통계학적 편향을 심화시키는 부작용을 해결하고자 한다.#Review#Large Language Models#Model Compression#Pruning#Debiasing#Hessian#SparseGPT#Fairness2026년 9월 2일댓글 수 로딩 중
[논문리뷰] Why Muon Outperforms Adam: A Curvature Perspective본 논문은 LLM pretraining에서 Muon이 왜 Adam보다 약 2배 빠른 학습 효율을 보이는지, 그 근본적인 기하학적 이유를 규명하고자 합니다.#Review#Muon#Adam#Curvature#Normalized Directional Sharpness (NDS)#Large Language Model#Optimization Landscape#Hessian2026년 6월 8일댓글 수 로딩 중