[논문리뷰] LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks본 논문은 기존의 에이전트 하네스가 긴 작업(long-horizon task)을 수행할 때 발생하는 일관성 저하와 신뢰성 문제를 해결하고자 합니다.#Review#Long-Horizon Agents#Task-State Management#Manage-Execute-Audit (MEA)#AgentAdapter#Computer Use#System Robustness2026년 8월 3일댓글 수 로딩 중
[논문리뷰] AdvEvo-MARL: Shaping Internalized Safety through Adversarial Co-Evolution in Multi-Agent Reinforcement LearningLLM 기반 다중 에이전트 시스템(MAS)이 jailbreak, prompt-injection, adversarial collaboration과 같은 공격에 취약한 문제를 해결하는 것을 목표로 합니다.#Review#Multi-Agent Reinforcement Learning#Adversarial Co-evolution#LLM Safety#Jailbreak Attacks#Internalized Safety#Public Baseline#System Robustness2025년 10월 7일댓글 수 로딩 중