[논문리뷰] Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill본 논문은 기존의 자율 연구 에이전트들이 별도의 독립적인 플랫폼과 복잡한 오케스트레이션 인프라를 필요로 하는 폐쇄적 구조라는 점에 주목하여, 이를 코딩 어시스턴트 내부의 재사용 가능한 스킬 형태로 구현하고자 한다.#Review#Autonomous Research Agents#Research Paper Generation#Composable Skills#Coding Assistants#Self-Critique#Evidence-Grounded Generation#Editable Figures2026년 8월 12일댓글 수 로딩 중
[논문리뷰] CritiCal: Can Critique Help LLM Uncertainty or Confidence Calibration?본 연구는 대규모 언어 모델(LLM)의 자연어 기반 신뢰도 표현(verbalized confidence) 의 정확한 보정(calibration)을 개선하는 것을 목표로 합니다.#Review#LLM Calibration#Confidence Calibration#Uncertainty Estimation#Critique Learning#Supervised Fine-Tuning#Natural Language Processing#Self-Critique2025년 11월 9일댓글 수 로딩 중