[논문리뷰] Multi-agent cooperation through in-context co-player inference다중 에이전트 강화 학습(MARL)에서 자기 이익을 추구하는 에이전트 간의 협력을 유도하는 근본적인 문제를 해결하고자 합니다.#Review#Multi-Agent Reinforcement Learning#In-Context Learning#Cooperation#Sequence Models#Opponent Shaping#Iterated Prisoner's Dilemma#Predictive Policy Improvement2026년 2월 18일댓글 수 로딩 중