[논문리뷰] Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses본 논문은 긴 호흡의 에이전트 작업에서 발생하는 재귀적 자기 개선(Recursive Self-Improvement, RSI)의 불투명성과 성능 저하 문제를 해결합니다.#Review#Long-Horizon Agents#Recursive Self-Improvement#Working Memory#Experiential Memory#Failure Localization#Agent Harness2026년 8월 25일댓글 수 로딩 중
[논문리뷰] TRACE-Bench: Decomposing and Diagnosing Multi-Reference Image Generation기존의 multi-reference image generation 벤치마크는 task-oriented 방식으로 구성되어 combinatorial setting에 부적합하며, 이는 incomplete coverage, no failure diagnosis, 그리고 uncontrolled complexity라는 세 가지 주요 한계를 야기한다.#Review#Multi-Reference Image Generation#Capability-Oriented Benchmark#Diagnostic Tree Analysis#Atomic Operators#Evaluation Protocol#Failure Localization#Compositional Formulas#Attribute Disentanglement2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures본 논문은 Agentic 시스템의 Failure가 발생했을 때, 이를 해결하기 위한 명확한 수정 지점을 찾기 어렵다는 Repair-Assignment 문제를 해결하고자 합니다.#Review#Agentic AI#Failure Taxonomy#Root-cause Analysis#Agentic System#Failure Localization#Interaction-Centric#Evaluation2026년 8월 3일댓글 수 로딩 중