[논문리뷰] DiagEvo: Diagnosis-Guided Self-Evolution via Hierarchical Error Memory본 논문은 기존의 자기 주도적 학습(Self-Play) 방식이 외부 자원 없이 학습을 진행할 때 성능 향상이 정체되거나 수렴하지 않는 문제를 해결하고자 한다. 기존의 Label-free 방식은 solver의 실패 이력을 종합적으로 분석하지 못해 단순히 문제의 표면적 복잡도만 증가시키는 경향이 있다.#Review#Self-Evolution#Self-Play#Large Language Models#Curriculum Learning#Error Memory#Diagnosis-Guided#Reinforcement Learning2026년 9월 1일댓글 수 로딩 중