[논문리뷰] Rufus-Air: An Open LLM Post-Training Recipe본 논문은 오픈-웨이트 기반 LLM 체크포인트가 Post-Training 연구의 진입 장벽을 낮추었음에도 불구하고, 실제 Reproducible한 Post-Training Recipe가 부족하다는 문제를 제기한다.#Review#LLM Post-Training#Reinforcement Learning#Agentic Capabilities#Supervised Fine-Tuning#GLM-4.5-Air-Base#Open-Source Recipe#Reward Design#Scalability2026년 9월 24일댓글 수 로딩 중