[논문리뷰] APort Vault: Benchmarking AI Agent Payment Authorization with the Open Agent Passport본 논문은 기존의 LLM 안전성 벤치마크가 대부분 '모델의 거부 여부'에만 초점을 맞추어, 실제 배포 환경에서의 잔여 위험(Residual Risk)을 적절히 측정하지 못한다는 한계를 지적합니다.#Review#AI Agents#Payment Authorization#Open Agent Passport#Adversarial Benchmarking#Tool-using Agents#LLM Security2026년 9월 20일댓글 수 로딩 중