[논문리뷰] HarnessRisk: A Lifecycle-Oriented Benchmark for Agent Harness Safety본 논문은 LLM 기반 에이전트의 안전성이 단순히 모델 자체의 문제가 아니라, 모델과 에이전트 런타임인 Agent Harness 간의 복합적인 상호작용에서 발생한다는 점을 지적합니다.#Review#Agent Safety#Harness#Benchmark#Lifecycle-Oriented#LLM#Sandboxed Evaluation#Attack Success Rate2026년 8월 18일댓글 수 로딩 중