[논문리뷰] Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning본 논문은 LLM이 자신의 능력 범위를 인지하지 못하고, 해결 불가능한 문제에 대해 그럴듯한 거짓 추론(Futile Reasoning)을 지속하는 심각한 신뢰성 문제를 해결하고자 한다 .#Review#Futile Reasoning#Capability Alignment#Reinforcement Learning#Refusal#LLM Reliability#Reward Shaping2026년 8월 13일댓글 수 로딩 중
[논문리뷰] MMOOC: A Comprehensive Benchmark for Out-of-Context Evaluation in Multimodal Large Language Models본 논문은 MLLM이 불완전한 시각적 맥락(Imperfect Context) 하에서 거부와 답변 능력을 적절히 균형 잡지 못하는 신뢰성 문제를 해결하고자 합니다.#Review#Multimodal Large Language Models#Out-of-Context#Benchmark#Refusal#Robust Answering#Shifted In-Context#Model Reliability2026년 8월 10일댓글 수 로딩 중