[논문리뷰] Selecting The Most Informative Tokens in Natural Language Autoencoders본 논문은 Natural Language Autoencoders (NLAs)를 활용한 모델 감사의 비용 효율성 및 효과성 문제를 다룹니다.#Review#Natural Language Autoencoders#NLA#Token Selection#Interpretability#Prompt Injection#Concealment#Audit Efficiency#Activation Signals2026년 9월 29일댓글 수 로딩 중