[논문리뷰] Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States본 연구는 fine-tuning 과정에서 발생하는 LLM의 내재적 편향 변화를 효과적으로 감지하기 위한 reference-based auditing 프레임워크를 제안합니다.#Review#Large Language Models#Bias Detection#Relative Representations#Hidden States#Fine-tuning#Model Auditing#Representational Bias Shift2026년 9월 9일댓글 수 로딩 중