[논문리뷰] From Reweighting to Rewriting: Unlocking the Intervention Effects of Influential Samples in Training Data AttributionLarge Language Models (LLMs)의 다양한 Capabilities와 Behaviors는 학습 데이터로부터 형성되지만, 어떤 학습 예제가 이러한 Behaviors를 야기하는지에 대한 이해는 부족한 상태입니다.#Review#Training Data Attribution#Influence Functions#Supervised Fine-tuning#Response Rewriting#Reweighting#Language Model Abstention#Safety Refusal#Behavioral Intervention2026년 9월 9일댓글 수 로딩 중