[논문리뷰] AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces본 논문은 LLM 기반 에이전트가 긴 호흡의 과제(Long-horizon tasks)에서 작은 오류가 누적되어 전체 실패로 이어지는 'jagged intelligence' 문제를 해결하고자 한다.#Review#LLM Agents#Harness Optimization#Automatic Programming#Failure Diagnosis#Structured Intervention#Offline Learning#EvoDAG2026년 8월 25일댓글 수 로딩 중
[논문리뷰] Self-Evolving Embodied Agents via Skill-Harness Evolution본 논문은 Frozen 상태의 embodied agent가 새로운 환경에 직면했을 때 파라미터 업데이트 없이 효과적으로 적응할 수 있는 방법을 탐구합니다.#Review#Embodied Agents#Train-free Adaptation#Foundation Models#Skill Evolution#Harness Optimization#VLA#Rollout-guided Diagnosis2026년 8월 12일댓글 수 로딩 중
[논문리뷰] HarnessOpt-Bench: Evaluating LLMs at Harness Optimization본 논문은 LLM 기반 Agent 시스템의 핵심인 Harness를 자동 최적화하는 능력을 측정하기 위한 표준화된 프로토콜인 HarnessOpt-Bench를 제안합니다. 기존 연구들은 각기 다른 시드, 평가 예산, 스코어링 프로토콜을 사용하여 모델 간의 비교가 불가능한 파편화된 환경에 있었습니다 .#Review#Harness Optimization#LLM Agents#Automated Code Optimization#Agentic Systems#Benchmark#Self-Improvement2026년 8월 6일댓글 수 로딩 중
[논문리뷰] SkillOpt-Lite: Better and Faster Agent Self-evolution via One Line of Vibe본 논문은 기존의 Agent Skill 최적화 프레임워크들이 과도하게 복잡해지고 있다는 점을 지적하며, 이론적·실증적으로 정당화 가능한 Minimal Viable Pipeline의 필요성을 제기합니다.#Review#Agent Self-evolution#Skill Optimization#Zeroth-Order Optimization#PAC-Learning#Harness Optimization#Minimal Viable Pipeline2026년 7월 7일댓글 수 로딩 중