[논문리뷰] Are You Sure You're Sure? On the Impact of Instruction Tuning on Confidence and Lexical Diversity본 논문은 Instruction Tuning이 모델의 verbalized overconfidence를 유발한다는 기존 연구에 주목하여, 이러한 confidence의 변화가 생성된 근거(Rationale)의 어휘적 다양성과 어떤 상관관계가 있는지 규명하고자 한다.#Review#Instruction Tuning#Model Confidence#Lexical Diversity#Question Answering#Calibration#Rationale#Uncertainty Estimation2026년 8월 13일댓글 수 로딩 중
[논문리뷰] Metacognition in LLMs: Foundations, Progress, and Opportunities본 논문은 LLM이 인간의 고유한 지적 능력으로 여겨지는 Metacognition을 어느 수준까지 발휘할 수 있는지, 그리고 이를 어떻게 시스템 수준에서 구현하여 성능과 신뢰성을 높일 수 있는지에 대한 체계적인 분석을 목표로 합니다.#Review#Metacognition#Large Language Models#Confidence Calibration#Self-Correction#Uncertainty Estimation#Artificial Intelligence#Cognitive Psychology2026년 7월 13일댓글 수 로딩 중
[논문리뷰] Process Rewards with Learned Reliability본 논문은 기존 PRM이 중간 단계에 대해 단일 Scalar 보상값만을 제공하여, 해당 점수의 신뢰도를 평가할 수 없는 한계점을 해결하고자 합니다.#Review#Process Reward Model#Beta-Binomial#Adaptive Computation Allocation#Test-Time Scaling#Uncertainty Estimation2026년 5월 19일댓글 수 로딩 중
[논문리뷰] TwinTrack: Post-hoc Multi-Rater Calibration for Medical Image Segmentation본 논문은 PDAC 세그멘테이션과 같이 전문가 간 의견 불일치가 빈번한 의료 영상 분석에서 기존의 단일 정답 기반 모델이 과도하게 높은 확신(overconfidence)을 보이는 문제를 해결하고자 합니다.#Review#PDAC#Multi-rater Calibration#Medical Image Segmentation#Isotonic Regression#MHR#Uncertainty Estimation#Deep Ensemble2026년 4월 19일댓글 수 로딩 중
[논문리뷰] GroupEnsemble: Efficient Uncertainty Estimation for DETR-based Object DetectionDETR 기반 객체 탐지 모델이 의미론적 불확실성 만 제공하고 공간적 불확실성 을 포착하지 못하는 한계를 해결하는 것을 목표로 합니다.#Review#Uncertainty Estimation#Object Detection#DETR#Deep Ensembles#MC-Dropout#Group DETR#Transformer#Autonomous Driving2026년 3월 4일댓글 수 로딩 중
[논문리뷰] No Global Plan in Chain-of-Thought: Uncover the Latent Planning Horizon of LLMs본 연구는 Large Language Models (LLMs)의 Chain-of-Thought (CoT) 추론 과정에서 내재된 계획 능력(latent planning horizon) 을 규명하는 것을 목표로 합니다.#Review#Chain-of-Thought#LLM Planning#Probing Methods#Uncertainty Estimation#Reasoning Dynamics#Model Interpretability2026년 2월 3일댓글 수 로딩 중
[논문리뷰] CritiCal: Can Critique Help LLM Uncertainty or Confidence Calibration?본 연구는 대규모 언어 모델(LLM)의 자연어 기반 신뢰도 표현(verbalized confidence) 의 정확한 보정(calibration)을 개선하는 것을 목표로 합니다.#Review#LLM Calibration#Confidence Calibration#Uncertainty Estimation#Critique Learning#Supervised Fine-Tuning#Natural Language Processing#Self-Critique2025년 11월 9일댓글 수 로딩 중