[논문리뷰] OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding본 논문은 LLM Agent가 단순한 코딩을 넘어 실제 업무 현장에서 긴 시간 소요되는 오피스 워크플로우를 처리하는 능력을 평가하기 위한 표준화된 벤치마크의 부재 문제를 해결하고자 합니다.#Review#LLM Agents#Office-Suite Tasks#Long-Horizon#Economic Grounding#Benchmark#Productivity#Code-based Verification2026년 7월 29일댓글 수 로딩 중