[논문리뷰] Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States본 연구는 fine-tuning 과정에서 발생하는 LLM의 내재적 편향 변화를 효과적으로 감지하기 위한 reference-based auditing 프레임워크를 제안합니다.#Review#Large Language Models#Bias Detection#Relative Representations#Hidden States#Fine-tuning#Model Auditing#Representational Bias Shift2026년 9월 9일댓글 수 로딩 중
[논문리뷰] EXPL-FR: Explaining Face Recognition Models via Vision-Language Alignment현대의 Deep Face Recognition(FR) 모델들은 99% 이상의 고도화된 정확도를 기록하고 있음에도 불구하고, 왜 특정 인물을 동일인으로 판단했는지에 대한 내부 추론 과정이 불투명하다는 문제에 직면해 있습니다.#Review#Face Recognition#Explainability#Vision-Language Models#Semantic Signature#Model Auditing#Zero-Shot Transfer2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Differences That Matter: Auditing Models for Capability Gap Discovery and Rectification본 논문은 기존 MLLM 평가 방법론의 해석력 부족 과 중요한 능력 격차를 포착하지 못하는 한계 를 해결하고자 합니다. 특히 모델의 고질적인 약점 과 실패 모드 를 자동으로 식별하고 해석하며, 이를 효과적으로 개선 할 수 있는 프레임워크를 구축하는 것을 목표로 합니다.#Review#MLLM#Model Auditing#Capability Gaps#Failure Mode Discovery#Reinforcement Learning#Data Rectification#Counterfactual Generation#VQA2025년 12월 18일댓글 수 로딩 중