[논문리뷰] GameXpert-Bench: How Far Are Coding Agents from Expert Game Development?본 논문은 현대의 Coding Agent들이 게임 개발 과정에서 보여주는 능력을 종합적으로 평가하기 위한 체계적인 벤치마크 시스템의 부재 문제를 해결하고자 합니다 .#Review#Coding Agents#Game Development#Benchmark#GameGen#GameFix#GameOpt2026년 8월 24일댓글 수 로딩 중
[논문리뷰] From Generation to Simulation: How Far Are World Models from Being True Simulators?본 논문은 Generative World Models가 전통적인 시뮬레이터를 대체할 새로운 범용 시뮬레이션 플랫폼이 될 수 있는지에 대한 근본적인 의문을 제기합니다. 현재 대부분의 연구가 모델의 아키텍처나 애플리케이션 도메인에 치중해 있어, 시뮬레이터로서 요구되는 필수 성능에 대한 통합적인 평가는 부족한 실정입니다.#Review#World Models#Generative Simulation#Simulator Capabilities#Physical Plausibility#State Feedback#Long-horizon Stability#Embodied AI2026년 8월 24일댓글 수 로딩 중
[논문리뷰] EchoWM: Open and Enterable Omnimodal World Models본 논문은 기존의 생성형 모델들이 프롬프트 기반의 수동적인 방식에 머물러 있어, 사용자가 환경을 직접 탐험하고 상호작용하는 ‘Enterable’한 경험을 제공하지 못하는 문제를 해결하고자 합니다.#Review#World Models#Omnimodal Generation#Camera-Intent Conditioning#6-DoF Trajectory#Progressive Training#Audio-Visual Synchronization2026년 8월 24일댓글 수 로딩 중
[논문리뷰] EXPL-FR: Explaining Face Recognition Models via Vision-Language Alignment현대의 Deep Face Recognition(FR) 모델들은 99% 이상의 고도화된 정확도를 기록하고 있음에도 불구하고, 왜 특정 인물을 동일인으로 판단했는지에 대한 내부 추론 과정이 불투명하다는 문제에 직면해 있습니다.#Review#Face Recognition#Explainability#Vision-Language Models#Semantic Signature#Model Auditing#Zero-Shot Transfer2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion본 논문은 기존 3D 생성 모델들이 가진 고품질 3D 에셋 생성과 낮은 추론 비용(Inference Cost) 간의 트레이드오프 문제를 해결하는 것을 목표로 합니다.#Review#Text-to-3D generation#Block-wise diffusion#Efficient inference#Confidence-guided correction#3D shape generation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Beyond the Stability-Exploration Dilemma: Environmental Regularization for LLM Policy Optimization본 논문은 LLM Policy Optimization 과정에서 발생하는 '안정성-탐색(Stability-Exploration) 딜레마'를 해결하고자 합니다.#Review#Policy Optimization#LLM#Reinforcement Learning#Query-KL#Stability#Environmental Regularization#Distribution Drift2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Beyond Imitation: Filtering On-Policy Distillation by Reasoning Progress본 논문은 기존의 OPD가 교사 모델과의 토큰 수준 일치만을 중요시하여, 실제 추론 성능 향상과는 배치되는 오해의 소지가 있는 지도 신호를 제공할 수 있다는 문제를 제기합니다.#Review#On-Policy Distillation#Reasoning Progress#Process Reward#Reward Filtering#Language Models#Knowledge Distillation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Better Retrieval, Worse Robustness:How Multi-hop RAG Amplifies Upstream ASR Errors본 논문은 구조적으로 복잡한 Multi-hop RAG 시스템이 업스트림 ASR Error를 흡수하여 견고성을 유지하는지, 아니면 오히려 오류를 증폭시키는지를 규명합니다. 기존 연구는 단일 홉 질문에 대한 성능 저하에 집중했으나, 다중 홉 검색 과정에서 발생하는 복잡한 의존성은 충분히 다루어지지 않았습니다.#Review#Multi-hop RAG#ASR Error#Robustness#Entity Corruption#Retrieval-Augmented Generation#Speech-based Applications2026년 8월 24일댓글 수 로딩 중
[논문리뷰] AutoResearch: Insight In, Hallucination Out본 논문은 자율 연구 시스템의 자동화 수준은 높아지고 있으나, 그 과정이 과학적으로 타당하고 근거 기반으로 유지되는지 확인하는 'grounding' 문제가 해결되지 않았다는 점에 주목합니다.#Review#Autonomous Research#Multi-Agent System#Idea Generation#Idea Execution#Grounding#Hallucination Mitigation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] Apodex 1.1: Scaling Agentic Intelligence for Complex Work본 논문은 일반적인 언어 모델이 추론과 지식 합성에는 뛰어나지만, 실제 업무의 핵심인 '장기적인 작업 수행'에는 한계가 있다는 점을 지적한다.#Review#Agentic Intelligence#Environment Scaling#Agentic Coordination#Heavy-Duty Solver#AgentOS#Long-Horizon Work#Reinforcement Learning2026년 8월 24일댓글 수 로딩 중
[논문리뷰] ARC: Fair Relative Advantage Comparison in Open-Ended Real-World Interaction본 논문은 오픈 엔디드(Open-Ended)한 실제 상호작용 상황에서 기존 Group-based RL이 직면한 '보상 공정성 문제(Reward Fairness Problem)'를 해결하고자 합니다.#Review#Reinforcement Learning#AI Agents#Tool Use#Interaction Strategies#Advantage Estimation2026년 8월 24일댓글 수 로딩 중
[논문리뷰] UniSpace: Unified Visual Representation and Scalable Multimodal Modeling본 논문은 기존 Multimodal Model이 이해와 생성을 위해 분리된 시각적 표현 공간(주로 Semantic Encoder와 VAE Latent)을 사용하는 문제를 해결하고자 한다 .#Review#Multimodal Modeling#Patch Reparameterization#Unified Visual Representation#Flow Matching#Vision Transformer#Image Generation#Image Editing2026년 8월 23일댓글 수 로딩 중
[논문리뷰] Towards Faithful Simulation of Human Shopping Behavior본 논문은 e-commerce 환경에서 인간의 쇼핑 행동을 충실하게 모사(Faithful Simulation)하는 Agent를 구축하는 데 있어 발생하는 두 가지 핵심 난제를 해결하고자 합니다.#Review#User Simulation#GUI Agents#Recommender Systems#Reinforcement Learning#Memory System#Human-Computer Interaction2026년 8월 23일댓글 수 로딩 중
[논문리뷰] ParaTempo: Efficient Parallel Reasoning via Temporal Confidence본 논문은 대규모 추론 모델(Large Reasoning Models)의 Parallel Reasoning 과정에서 발생하는 과도한 컴퓨팅 비용과 고정된 자원 할당 문제를 해결하고자 합니다.#Review#Parallel Reasoning#Temporal Confidence#Test-Time Scaling#Asynchronous Branch Control#Inference Efficiency#Large Reasoning Models2026년 8월 23일댓글 수 로딩 중
[논문리뷰] OmniAssistBench: Assistant-style Interaction Benchmark for Omni-LLMs본 논문은 기존의 수동적인 비디오 이해 평가 방식이 실시간 상호작용 환경에서의 Omni-LLMs 성능을 측정하는 데 한계가 있음을 지적합니다. 기존 벤치마크는 정적 데이터를 활용하지만, 실제 인터랙티브 어시스턴트는 모델의 응답이 사용자의 후속 행동을 변화시키는 동적 상호작용을 수행해야 합니다 .#Review#Omni-LLMs#Video Assistant#Benchmark#Interaction Path#Multi-modal#Action Recognition#Long-term Memory2026년 8월 23일댓글 수 로딩 중
[논문리뷰] Llama-Mobile: Efficient 2.7-Bit Quantization of VLMs본 논문은 VLM을 모바일 및 자원 제약 환경에 배포할 때 발생하는 막대한 메모리 및 컴퓨팅 자원 요구 문제를 해결하고자 합니다.#Review#Vision-Language Models#Quantization-Aware Training#Model Compression#Numerical Formats#Mobile Inference#Arm CPU2026년 8월 23일댓글 수 로딩 중
[논문리뷰] Let's Scale Step by Step: Compute-Efficient Hyperparameter Transfer for Large-Scale Mixture-of-Experts본 논문은 대규모 MoE 모델 훈련 시 필수적인 하이퍼파라미터, 특히 Learning Rate 최적화의 높은 비용과 복잡성 문제를 해결합니다. 기존의 2D 하이퍼파라미터 스윕(모델 규모 및 토큰 수 탐색)은 모델이 커질수록 계산 비용이 기하급수적으로 증가하여 실행 불가능한 수준입니다 .#Review#Mixture-of-Experts#Hyperparameter Transfer#Maximal Update Parameterization#Scaling Laws#Foundation Model2026년 8월 23일댓글 수 로딩 중
[논문리뷰] InfinityEdit: Infinite Video Editing with a Lightweight Edit-Ignition Adapter본 논문은 기존의 고정된 프레임 범위에서만 작동하는 in-place 편집 방식의 한계를 극복하고, 개방형 스트리밍 환경에서 무제한으로 이어지는 비디오 편집을 수행하는 Infinite Video Editing을 제안합니다.#Review#Infinite Video Editing#Streaming Video Generation#Edit-Ignition Adapter#Diffusion Transformer#Flow-Matching#Temporal Consistency2026년 8월 23일댓글 수 로딩 중
[논문리뷰] Human-Centric Intelligence in the Era of Foundation Models: A Survey본 논문은 Foundation Model 시대에 분산되어 있는 인간 중심 지능(Human-Centric Intelligence) 연구들을 통합적인 관점에서 체계화하고자 합니다.#Review#Foundation Models#Human-Centric Intelligence#Human Context Taxonomy#Embodied Agency#Visual Appearance#Spatial Geometry#Interaction Modeling2026년 8월 23일댓글 수 로딩 중
[논문리뷰] Hadith computational science in the age of large language models: a critical narrative review본 논문은 급변하는 Transformer 및 LLM 시대에 Hadith 계산 과학(Hadith computational science)의 현주소를 비판적으로 재검토하고자 한다.#Review#hadith computation#hadith NLP#large language models#Islamic scholarship#expert-in-the-loop AI#narrative review2026년 8월 23일댓글 수 로딩 중