[논문리뷰] ToolHazard: Scaling Adversarial Environments for Security Evaluation and Alignment of LLM-based Agents본 논문은 기존의 Agent 보안 연구가 수동으로 구현된 환경에 의존하여 확장성이 낮고, LLM 기반 도구 시뮬레이션의 확률적 성격으로 인해 재현 가능한 평가가 어렵다는 문제를 해결한다.#Review#LLM Agents#Indirect Prompt Injection#Adversarial Environment#Safety Alignment#Tool-use#Benchmarking2026년 8월 12일댓글 수 로딩 중