[논문리뷰] UI-Venus-2 Technical Report본 논문은 기존 GUI 에이전트가 벤치마크 점수 향상에는 성공했으나, 실제 환경에서의 신뢰성(Dependability)과 범용성(Generalization) 측면에서 여전히 한계를 가지고 있다는 점을 지적합니다 .#Review#GUI Agents#Multimodal Foundation Models#Reinforcement Learning#System Scalability#Trajectory Verification#Computer Use2026년 9월 1일댓글 수 로딩 중
[논문리뷰] LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks본 논문은 기존의 에이전트 하네스가 긴 작업(long-horizon task)을 수행할 때 발생하는 일관성 저하와 신뢰성 문제를 해결하고자 합니다.#Review#Long-Horizon Agents#Task-State Management#Manage-Execute-Audit (MEA)#AgentAdapter#Computer Use#System Robustness2026년 8월 3일댓글 수 로딩 중
[논문리뷰] LUMOS: A Semantic Operating-System Layer for Accessibility-Grounded AI Agents본 논문은 기존 운영체제가 인간 사용자에게 최적화되어 있어 AI 에이전트의 효율적인 제어를 방해한다는 문제점을 해결하고자 합니다.#Review#AI Agents#Operating Systems#Accessibility#Semantic Blueprint#UI Automation#Computer Use#LLM2026년 6월 30일댓글 수 로딩 중