[논문리뷰] Securing the AI Agent: A Unified Framework for Multi-Layer Agent Red Teaming본 논문은 현대 AI 인프라가 급격히 성장함에 따라 기존 보안 도구가 해결하지 못하는 새로운 공격 표면이 형성되었음을 지적합니다. .#Review#AI Security#Agent Red Teaming#Model Context Protocol (MCP)#Infrastructure Scanning#LLM-driven Auditing#Supply Chain Security2026년 7월 5일댓글 수 로딩 중
[논문리뷰] Steerability of Instrumental-Convergence Tendencies in LLMs본 논문은 AI 시스템의 역량(capability) 성장과 제어 가능성(steerability) 간의 관계를 탐구하며, 특히 도구적 수렴(instrumental convergence) 경향에 초점을 맞춥니다.#Review#LLM Steerability#Instrumental Convergence#AI Safety#AI Security#Open-Weight Models#Prompt Engineering#Model Control#Behavioral Alignment2026년 1월 6일댓글 수 로딩 중