[논문리뷰] StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing본 논문은 LLM 기반 에이전트의 실질적인 위험(파일 변조, 정보 유출 등)을 사전에 차단하기 위한 Step-level 안전 감독 기술의 부재를 해결하고자 합니다.#Review#LLM Agents#Guardrails#Step-level Supervision#Safety-Utility Balancing#Balance-GRPO#Synthetic Data2026년 8월 30일댓글 수 로딩 중