[논문리뷰] Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning본 논문은 LLM이 자신의 능력 범위를 인지하지 못하고, 해결 불가능한 문제에 대해 그럴듯한 거짓 추론(Futile Reasoning)을 지속하는 심각한 신뢰성 문제를 해결하고자 한다 .#Review#Futile Reasoning#Capability Alignment#Reinforcement Learning#Refusal#LLM Reliability#Reward Shaping2026년 8월 13일댓글 수 로딩 중
[논문리뷰] Generalization or Memorization: Dynamic Decoding for Mode Steering대규모 언어 모델(LLMs)이 보이는 예측 불가능한 일반화(Generalization)와 암기(Memorization) 간의 전환 문제를 해결하는 것이 목표입니다. 이러한 이중적인 추론 모드를 이해하고, 식별하며, 제어하는 통일된 프레임워크를 제시하여 LLM의 신뢰성을 향상시키고자 합니다.#Review#Large Language Models (LLMs)#Generalization#Memorization#Information Bottleneck (IB)#Activation Steering#Decoding Strategy#Causal Intervention#LLM Reliability2025년 10월 29일댓글 수 로딩 중