[논문리뷰] GPT-Red: Automated Red Teaming via Self-Play at Scale본 논문은 현대의 agentic LLM이 복잡한 환경에서 외부 공격으로부터 안전하게 작동하기 위한 확장 가능한 자동 red-teaming 프레임워크의 부재를 해결합니다.#Review#GPT-Red#Self-Play#Red Teaming#Prompt Injection#Adversarial Robustness#Reinforcement Learning2026년 7월 29일댓글 수 로딩 중