[논문리뷰] AREX: Towards a Recursively Self-Improving Agent for Deep Research본 논문은 심층 연구(Deep Research) 과정에서 발생하는 정보 탐색과 검증 간의 불균형 및 장기 탐색의 효율성 문제를 해결하고자 합니다 . 기존 연구 시스템은 단순한 탐색 시간 확장이나 문맥 누적에 의존하여, 초기 단계의 오류가 증폭되거나 중복된 탐색이 반복되는 한계가 있습니다.#Review#Deep Research#Recursively Self-Improving#Agentic Mid-training#Reinforcement Learning#Context-Update#Discovery-Verification Asymmetry2026년 7월 23일댓글 수 로딩 중