[논문리뷰] SKILLER: Language-Level Reinforcement Learning for Reusable Skill Extraction in Small Language Models본 논문은 강력한 closed-source 모델의 높은 추론 비용 문제와, 소형 모델(Small-scale LVLMs)에 기존 스킬을 직접 이식할 때 발생하는 Model-Mismatch 문제를 해결하고자 한다.#Review#Small Language Models#Reinforcement Learning#Agent Skills#Natural Language Policy#Model-Mismatch#Cost-Effectiveness#Agentic Deployment2026년 8월 13일댓글 수 로딩 중