[논문리뷰] Scaling Large Reasoning Models beyond Human Supervision: A Path toward Superintelligence본 논문은 Large Reasoning Models (LRMs)가 인간의 Supervision이 모델 생성 경험의 규모와 복잡성을 따라잡기 어려워지는 상황에서도 추론 능력을 지속적으로 향상시킬 수 있는 방법을 모색합니다.#Review#Large Reasoning Models#Human Supervision#Superintelligence#Reinforcement Learning#Reward Models#Self-play#Autonomous Agents#Curriculum Learning2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Skill Issue: Are Skills Language-Invariant in LLMs?본 논문은 LLM이 서로 다른 언어 환경에서 상호작용할 때, 단순히 지식의 접근성뿐만 아니라 근본적인 기술(Skill) 수준까지 달라지는지 규명하고자 합니다.#Review#Multilingual LLMs#TextArena#Cross-lingual Skill Inconsistency#Self-play#Language Interface#Agentic Gameplay2026년 8월 26일댓글 수 로딩 중
[논문리뷰] Search Self-play: Pushing the Frontier of Agent Capability without Supervision본 논문은 LLM 에이전트 훈련의 주요 병목인 대규모 인간 주석 데이터 의존성 문제를 해결하고자 합니다.#Review#LLM Agents#Self-play#Reinforcement Learning#Search Agents#Supervision-Free Training#Retrieval-Augmented Generation (RAG)#Task Generation#Curriculum Learning2025년 10월 24일댓글 수 로딩 중