[논문리뷰] Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations본 논문은 LLM이 학습 데이터 내의 사회적 편향을 구조적으로 내재화하는 문제를 해결하기 위해, 모델의 일반적 능력을 저하시키지 않으면서 편향만을 정밀하게 제거하는 효율적인 방안을 탐색합니다.#Review#Large Language Models#Demographic Bias#Mechanistic Interpretability#Neural Pruning#GLU-MLP#Differential Activation2026년 7월 30일댓글 수 로딩 중