[논문리뷰] Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning본 논문은 의료 분야의 MLLM(Multimodal Large Language Model)이 추론 과정에서 겪는 Sparse Credit Assignment 문제와 그로 인한 Failure Cascades 현상을 해결하고자 합니다.#Review#Multimodal Large Language Models#Medical Reasoning#Reinforcement Learning#Process Supervision#Failure Cascades#Advantage Shaping#VQA2026년 7월 2일댓글 수 로딩 중
[논문리뷰] Measuring Epistemic Resilience of LLMs Under Misleading Medical Context본 논문은 최신 LLM이 의학적 시험에서는 우수한 성적을 거두지만, 실제 의료 환경의 복잡하고 오염된 정보 속에서는 판단 능력이 취약하다는 문제를 해결하고자 한다. 기존의 의료 벤치마크들은 주로 깨끗한(clean) 입력을 바탕으로 지식과 추론 능력을 평가하여 실제 배포 환경에서의 안정성을 과대평가하는 경향이 있다 .#Review#Epistemic Resilience#LLM Evaluation#Medical Misinformation#Robustness#Benchmark#Medical Reasoning2026년 6월 14일댓글 수 로딩 중