[논문리뷰] Prime Agent: A Self-Improving RLM Harness본 논문은 LLM이 단순히 시퀀스를 생성하는 것을 넘어, 장기적 목표를 달성하기 위해 필요한 외부 정보 및 계산 능력을 효과적으로 제공하지 못하는 한계를 해결하고자 합니다. 기존의 에이전트 시스템은 harness가 상태 관리에 실패하거나, 유연하지 못한 workflow로 인해 모델의 잠재력을 제한하는 경우가 많았습니다.#Review#Long-horizon Agency#Recursive Language Model (RLM)#Continual Harness#Test-time Compute#Agentic Workflow#Programmatic Execution2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Continual Harness: Online Adaptation for Self-Improving Foundation Agents본 논문은 embodied agent가 복잡하고 긴 호흡의 환경에서 명확한 도메인 스캐폴딩 없이도 자율적으로 학습하고 진화할 수 있는 체계를 구축하고자 합니다 .#Review#Foundation Agents#Continual Harness#Online Adaptation#Embodied AI#In-Context Learning#Reset-Free Training#Process Reward Models2026년 5월 12일댓글 수 로딩 중