[논문리뷰] InternReviewer & InternAdvocate: Objective Reward and Evaluation for Agentic Reinforcement Learning in Peer Review and Rebuttal본 연구는 학술 리뷰의 자동화 과정에서 발생하는 hallucination과 비전문적인 리뷰 생성을 해결하기 위해 수행되었습니다. 기존의 LLM 기반 리뷰 생성 모델들은 문체만 모방하거나, 존재하지 않는 문헌을 인용하는 등 사실관계 확인이 부족한 sycophantic한 리뷰를 생성하는 한계가 있습니다 .#Review#Agentic Reinforcement Learning#Peer Review#Rebuttal#Hallucination Suppression#Evidence-grounded Search#Objective Reward Function2026년 9월 1일댓글 수 로딩 중
[논문리뷰] Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making본 논문은 기존 의료 LLM이 보이는 수동적인 질문-답변 방식과 개방형 임상 상담에서의 환각 문제를 해결하고자 합니다. 능동적인 정보 획득, 장기적 추론, 적응형 환각 억제 기능을 갖춘 임상 등급의 의사결정 지원 시스템인 Baichuan-M3 를 개발하여 신뢰할 수 있는 의료 의사결정을 목표로 합니다.#Review#Medical LLM#Clinical Decision Support#Reinforcement Learning#Hallucination Suppression#Multi-task Learning#Speculative Decoding#Quantization#Clinical Inquiry2026년 2월 8일댓글 수 로딩 중