[논문리뷰] EDGEGEN: Improving Tool-Calling Agents Beyond Happy Paths with Synthetic Edge Case Generation본 논문은 엔터프라이즈 애플리케이션에서 Tool-Calling LLM Agents의 효과적인 평가 및 최적화를 위한 고품질의 다양하고 현실적인 태스크 데이터셋 확보의 어려움을 핵심 문제로 제기합니다.#Review#Tool-Calling Agents#Edge Cases#Synthetic Data Generation#Finetuning#Harness Optimization#Policy Compliance#Database Grounding#LLM Agents2026년 9월 21일댓글 수 로딩 중
[논문리뷰] PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents본 논문은 고객 서비스 LLM 에이전트가 비즈니스 정책을 준수하지 못하는 문제를 해결하기 위해 제안되었습니다.#Review#LLM Agents#Policy Compliance#Workflow Enforcement#Runtime Safeguards#Process Monitoring#Proactive Verifier2026년 8월 20일댓글 수 로딩 중
[논문리뷰] Scaling Policy Compliance Assessment in Language Models with Policy Reasoning Traces본 논문은 대규모 언어 모델(LLM)이 인간 전문가처럼 정책 준수 여부를 평가하는 데 필요한 체계적인 추론 과정을 모방하는 능력을 향상시키는 것을 목표로 합니다.#Review#Policy Compliance#Large Language Models (LLMs)#Reasoning Traces#In-Context Learning (ICL)#Supervised Finetuning (SFT)#HIPAA#GDPR#ModelSpec2025년 10월 6일댓글 수 로딩 중