[논문리뷰] InternReviewer & InternAdvocate: Objective Reward and Evaluation for Agentic Reinforcement Learning in Peer Review and Rebuttal본 연구는 학술 리뷰의 자동화 과정에서 발생하는 hallucination과 비전문적인 리뷰 생성을 해결하기 위해 수행되었습니다. 기존의 LLM 기반 리뷰 생성 모델들은 문체만 모방하거나, 존재하지 않는 문헌을 인용하는 등 사실관계 확인이 부족한 sycophantic한 리뷰를 생성하는 한계가 있습니다 .#Review#Agentic Reinforcement Learning#Peer Review#Rebuttal#Hallucination Suppression#Evidence-grounded Search#Objective Reward Function2026년 9월 1일댓글 수 로딩 중