[논문리뷰] An Open Recipe for IMO Gold: Training Nemotron for Olympiad Mathematics본 연구는 모델의 post-training 및 test-time inference 설계가 고난도 올림피아드 수학 증명 생성에 미치는 영향을 체계적으로 분석하고 최적의 파이프라인을 제시하는 것을 목표로 합니다.#Review#IMO#Nemotron-3-Ultra#Reinforcement Learning#Test-time-compute#Proof-generation#Olympiad Mathematics2026년 9월 10일댓글 수 로딩 중
[논문리뷰] Achieving Olympia-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning이 논문은 대규모 언어 모델(LLM) 에이전트가 국제 수학 올림피아드(IMO) 수준의 기하학 문제 를 해결하는 데 있어 기존 전문가 시스템의 한계를 극복하는 것을 목표로 합니다.#Review#LLM Agents#Geometry Problem Solving#Reinforcement Learning#Curriculum Learning#Auxiliary Construction#Symbolic Reasoning#IMO2025년 12월 11일댓글 수 로딩 중