[논문리뷰] MobilePA-Bench: Benchmarking Mobile Planner Agents on Complex Real-World Tasks본 논문은 기존 모바일 에이전트 벤치마크가 GUI 기반의 시각적 인식에 과도하게 의존하거나, Tool 사용 능력을 정적(static)인 환경에서만 평가하여 실제 모바일 OS의 동적 복잡성을 반영하지 못한다는 문제점을 해결하고자 합니다 .#Review#Mobile Planner Agents#Tool-centric Benchmark#Stateful Sandbox#Sub-agent Collaboration#Memory Usage#Skill Usage#Agentic Workflow2026년 8월 24일댓글 수 로딩 중
[논문리뷰] LongWoF-Bench: Evaluating EvoMap Genes for Verifiable Long-Workflow Tasks본 논문은 복잡한 다단계 워크플로우를 해결한 모델의 귀중한 실행 경험이 휘발되는 문제를 해결하고자 합니다. 기존 모델들은 어려운 작업을 성공적으로 수행하더라도 그 실행 전략이나 실패 모드가 공유되지 않아, 매번 새롭게 시행착오를 겪어야 하는 한계가 있습니다.#Review#Long-Workflow#EvoMap#Gene#Skill#Verifier#Benchmark#Task Completion2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Industrial-Instruction: An End-to-End Framework for Building Instruction-Tuning and Benchmark Datasets from Industrial Technical Reports본 연구는 산업 현장의 방대한 기술 문서 내 지식을 활용하고자 하지만, 기존 모델들이 전문적인 도메인 지식 부족과 복잡한 문서 구조 처리 미흡으로 인해 발생하는 'Industrial Gap' 문제를 해결하고자 합니다.#Review#Large Language Model#Fine Tuning#Industrial Question Answering#Retrieval-Augmented Generation#Synthetic Data Generation#Small Language Models2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Hybrid Quantum-inspired Kolmogorov-Arnold Networks for Privacy-Aware Federated Biosignal Learning본 논문은 ECG와 같은 민감한 생체 데이터의 프라이버시를 보호하면서도 Federated Learning(FL) 환경에서 효율적인 분류 모델을 학습시키는 문제를 다룹니다.#Review#Federated Learning#Kolmogorov–Arnold Networks#Electrocardiogram#Biosignal Processing#Communication Efficiency#Privacy-Aware#Data Re-Uploading2026년 8월 24일댓글 수 로딩 중
[논문리뷰] GameXpert-Bench: How Far Are Coding Agents from Expert Game Development?본 논문은 현대의 Coding Agent들이 게임 개발 과정에서 보여주는 능력을 종합적으로 평가하기 위한 체계적인 벤치마크 시스템의 부재 문제를 해결하고자 합니다 .#Review#Coding Agents#Game Development#Benchmark#GameGen#GameFix#GameOpt2026년 8월 24일댓글 수 로딩 중
[논문리뷰] From Generation to Simulation: How Far Are World Models from Being True Simulators?본 논문은 Generative World Models가 전통적인 시뮬레이터를 대체할 새로운 범용 시뮬레이션 플랫폼이 될 수 있는지에 대한 근본적인 의문을 제기합니다. 현재 대부분의 연구가 모델의 아키텍처나 애플리케이션 도메인에 치중해 있어, 시뮬레이터로서 요구되는 필수 성능에 대한 통합적인 평가는 부족한 실정입니다.#Review#World Models#Generative Simulation#Simulator Capabilities#Physical Plausibility#State Feedback#Long-horizon Stability#Embodied AI2026년 8월 24일댓글 수 로딩 중
[논문리뷰] EchoWM: Open and Enterable Omnimodal World Models본 논문은 기존의 생성형 모델들이 프롬프트 기반의 수동적인 방식에 머물러 있어, 사용자가 환경을 직접 탐험하고 상호작용하는 ‘Enterable’한 경험을 제공하지 못하는 문제를 해결하고자 합니다.#Review#World Models#Omnimodal Generation#Camera-Intent Conditioning#6-DoF Trajectory#Progressive Training#Audio-Visual Synchronization2026년 8월 24일댓글 수 로딩 중
[논문리뷰] EXPL-FR: Explaining Face Recognition Models via Vision-Language Alignment현대의 Deep Face Recognition(FR) 모델들은 99% 이상의 고도화된 정확도를 기록하고 있음에도 불구하고, 왜 특정 인물을 동일인으로 판단했는지에 대한 내부 추론 과정이 불투명하다는 문제에 직면해 있습니다.#Review#Face Recognition#Explainability#Vision-Language Models#Semantic Signature#Model Auditing#Zero-Shot Transfer2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion본 논문은 기존 3D 생성 모델들이 가진 고품질 3D 에셋 생성과 낮은 추론 비용(Inference Cost) 간의 트레이드오프 문제를 해결하는 것을 목표로 합니다.#Review#Text-to-3D generation#Block-wise diffusion#Efficient inference#Confidence-guided correction#3D shape generation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Beyond the Stability-Exploration Dilemma: Environmental Regularization for LLM Policy Optimization본 논문은 LLM Policy Optimization 과정에서 발생하는 '안정성-탐색(Stability-Exploration) 딜레마'를 해결하고자 합니다.#Review#Policy Optimization#LLM#Reinforcement Learning#Query-KL#Stability#Environmental Regularization#Distribution Drift2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Beyond Imitation: Filtering On-Policy Distillation by Reasoning Progress본 논문은 기존의 OPD가 교사 모델과의 토큰 수준 일치만을 중요시하여, 실제 추론 성능 향상과는 배치되는 오해의 소지가 있는 지도 신호를 제공할 수 있다는 문제를 제기합니다.#Review#On-Policy Distillation#Reasoning Progress#Process Reward#Reward Filtering#Language Models#Knowledge Distillation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Better Retrieval, Worse Robustness:How Multi-hop RAG Amplifies Upstream ASR Errors본 논문은 구조적으로 복잡한 Multi-hop RAG 시스템이 업스트림 ASR Error를 흡수하여 견고성을 유지하는지, 아니면 오히려 오류를 증폭시키는지를 규명합니다. 기존 연구는 단일 홉 질문에 대한 성능 저하에 집중했으나, 다중 홉 검색 과정에서 발생하는 복잡한 의존성은 충분히 다루어지지 않았습니다.#Review#Multi-hop RAG#ASR Error#Robustness#Entity Corruption#Retrieval-Augmented Generation#Speech-based Applications2026년 8월 24일댓글 수 로딩 중
[논문리뷰] AutoResearch: Insight In, Hallucination Out본 논문은 자율 연구 시스템의 자동화 수준은 높아지고 있으나, 그 과정이 과학적으로 타당하고 근거 기반으로 유지되는지 확인하는 'grounding' 문제가 해결되지 않았다는 점에 주목합니다.#Review#Autonomous Research#Multi-Agent System#Idea Generation#Idea Execution#Grounding#Hallucination Mitigation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Apodex 1.1: Scaling Agentic Intelligence for Complex Work본 논문은 일반적인 언어 모델이 추론과 지식 합성에는 뛰어나지만, 실제 업무의 핵심인 '장기적인 작업 수행'에는 한계가 있다는 점을 지적한다.#Review#Agentic Intelligence#Environment Scaling#Agentic Coordination#Heavy-Duty Solver#AgentOS#Long-Horizon Work#Reinforcement Learning2026년 8월 24일댓글 수 로딩 중
[논문리뷰] ARC: Fair Relative Advantage Comparison in Open-Ended Real-World Interaction본 논문은 오픈 엔디드(Open-Ended)한 실제 상호작용 상황에서 기존 Group-based RL이 직면한 '보상 공정성 문제(Reward Fairness Problem)'를 해결하고자 합니다.#Review#Reinforcement Learning#AI Agents#Tool Use#Interaction Strategies#Advantage Estimation2026년 8월 24일댓글 수 로딩 중
[flashinfer] FlashInfer GDN 커널의 SM90/SM120 비-CP 런치 오버헤드 감소 최적화 분석FlashInfer GDN 커널에서 SM90/SM120 GPU의 비-CP 런치 오버헤드를 줄여 성능을 개선한 PR 분석입니다.#FlashInfer#GDN#최적화#성능 개선#CUDA#TVM2026년 8월 24일댓글 수 로딩 중
[open-webui] Open WebUI 스트리밍 성능 190배 개선: O(N^2)에서 O(N)으로의 최적화스트리밍 응답 처리 시 매번 전체 텍스트를 재스캔하던 비효율을 제거하여 성능을 190배 향상시킨 사례를 분석합니다.#Python#Performance#Optimization#Open-WebUI#Streaming2026년 8월 24일댓글 수 로딩 중
[sglang] LingBot Video 성능 개선: 수동 RMSNorm 체인을 Triton 커널로 최적화하기LingBot Video의 수동 RMSNorm 연산을 Triton 커널로 대체하여 성능을 25% 이상 향상시킨 PR 분석#sglang#diffusion#optimization#Triton#RMSNorm#performance2026년 8월 24일댓글 수 로딩 중
[triton] Triton 컴파일러의 Reduce 연산 최적화: OptimizeThreadLocality 개선 분석Triton의 Reduce 연산 패턴 매칭을 재설계하여 컴파일러 최적화 범위를 확장하고 버그를 수정한 사례를 분석합니다.#Triton#Compiler#Optimization#GPU#MLIR2026년 8월 24일댓글 수 로딩 중
[논문리뷰] UniSpace: Unified Visual Representation and Scalable Multimodal Modeling본 논문은 기존 Multimodal Model이 이해와 생성을 위해 분리된 시각적 표현 공간(주로 Semantic Encoder와 VAE Latent)을 사용하는 문제를 해결하고자 한다 .#Review#Multimodal Modeling#Patch Reparameterization#Unified Visual Representation#Flow Matching#Vision Transformer#Image Generation#Image Editing2026년 8월 23일댓글 수 로딩 중