[논문리뷰] Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails본 논문은 Harness Evolution을 통해 성능을 높인 작은 모델들이 전문가 모델의 궤적을 모방(Imitation)할 때 발생하는 성능 저하 문제를 해결하고자 합니다.#Review#Agentic Tasks#Harness Evolution#On-Policy Correction#Model–Harness Fit#Imitation Learning#LoRA-SFT#Co-Evolution2026년 9월 9일댓글 수 로딩 중