[논문리뷰] GAE: Learning a Geometry-Native Latent Space for 3D-Consistent World Generation기존 시각 생성 모델들은 포토리얼리스틱(photorealistic)한 이미지를 생성하지만, 생성된 프레임들이 일관된 3D 장면을 보존하지 못하는 문제를 겪는다.#Review2026년 9월 22일댓글 수 로딩 중
[논문리뷰] From Pattern Recognizers to Personalized Companions: A Survey of Large Language Models in Mental Health본 연구는 정신 건강 문제의 전 세계적인 확산과 함께 전통적인 정신 건강 관리 시스템이 직면한 자원 부족, 높은 비용, 사회적 낙인, 개인 정보 보호 문제와 같은 장벽을 해결하고자 합니다.#Review#Mental Health#Large Language Models#Language Agents#Computational Psychiatry#Longitudinal Support2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Flash-dLLM: IO-Aware KV Caching and Parallel Decoding for Fast, Memory-Efficient Diffusion LLMs본 논문은 Diffusion Large Language Models (dLLMs)의 비효율적인 추론 속도와 제한적인 메모리 효율성 문제를 해결하고자 한다.#Review#Diffusion LLMs#Inference Acceleration#KV Caching#Parallel Decoding#IO-Aware#Draft-and-Verify#Memory Efficiency2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Emergent Collusion in Long-Horizon LLM Agent InteractionLLM Agents가 협업적인 장기 Workflow에 점점 더 많이 배포됨에 따라, 에이전트가 지속적인 인간 감독 없이 사용자 지시를 충실히 따르기보다는 지시를 회피하거나 위반하는 조정된 전략을 개발할 수 있다는 중요한 Safety Challenge가 발생한다.#Review2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Embedding Physics Priors in Robot Learning: A Survey로봇 학습 분야에서는 순수 데이터 기반(Purely Data-Driven) 방법론들이 컴퓨터 비전(Computer Vision)이나 자연어 처리(Natural Language Processing) 분야에서 보여준 성공에도 불구하고, 데이터 부족, 복잡한 실제 환경 상호작용, 그리고 안정적인 Operation의 필요성이라는 근본적인 한계에 직면해 있다.#Review#Physics Priors#Robot Learning#Physics-Embedded Learning#Physics-Informed Machine Learning#Physics-Encoded Architectures#Physics-Guided Data#Taxonomy#Robotics2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Circuit Hypernetworks for Quantum-Augmented Diffusion Language Models본 논문은 Large Language Models (LLMs)의 성능을 quantum circuits로 향상시키는 데 있어 기존 방법론들이 겪는 trainability 및 computational practicality 문제를 해결하고자 합니다.#Review#quantum machine learning#diffusion language models#circuit hypernetworks#variational quantum circuits#hybrid quantum–classical computing2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Blaming Across the Aisle: Political Contrasting and Blame Attribution in the Danish Parliament본 논문은 정치 담론의 적대성 증가에 대한 인식이 널리 퍼져 있음에도 불구하고, 특히 의회 환경에서의 견고한 실증적 증거가 부족하다는 문제를 제기합니다. 소셜 미디어에서의 비방은 연구되었지만, 의회 담론은 그 제도적 중요성에도 불구하고 상대적으로 덜 탐구되었습니다.#Review#Blame Attribution#Political Contrasting#Danish Parliament#Natural Language Processing#Ideological Extremity#BlameBERT#Temporal Dynamics#Political Discourse2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Bellman Policy Optimization본 논문은 Large Language Models (LLMs)의 추론 능력을 향상시키기 위한 Reinforcement Learning with Verifiable Rewards (RLVR) 접근 방식에서 발생하는 policy optimization의 비효율성 문제를 해결한다.#Review#Reinforcement Learning with Verifiable Rewards (RLVR)#Large Language Models (LLMs)#Bellman Policy Optimization (BPO)#Policy Mirror Descent (PMD)#Critic-Free Policy Optimization#Autoregressive Generation#Terminal Rewards#Mathematical Reasoning2026년 9월 22일댓글 수 로딩 중
[논문리뷰] All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-Experts본 논문은 Multilingual Scene Text Recognition (STR) 분야에서 대부분의 언어에 대한 학습 데이터 부족과 단일 모델 내에서 다양한 스크립트를 효율적으로 처리하기 어려운 문제를 해결하고자 합니다. 기존 연구들은 크게 두 가지 접근 방식을 취해왔지만, 각각 명확한 한계를 가지고 있습니다.#Review#Multilingual STR#Mixture-of-Experts#Script-aware#Synthetic Data#All-in-One Model2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Agensh: Scaling Organizational Intelligence to 1,024 Agents본 논문은 기존 Multi-Agent System의 중앙 Orchestrator가 야기하는 Scalability 제한 문제를 해결한다.#Review#Multi-Agent System#Organizational Intelligence#Self-Organized Cooperation#Scalability#ProgramBench#Distributed Systems#Large Language Models#Agentic Software Engineering2026년 9월 22일댓글 수 로딩 중
[논문리뷰] ALPINE: Adaptive Localization for Parameter- and Sample-Efficient Few-Shot LearningFew-shot learning 연구는 주로 accuracy 향상에 초점을 맞추고 있으며, real-world practitioner들에게 중요한 parameter 및 training-sample budgets에는 상대적으로 적은 관심을 기울이고 있습니다.#Review#few-shot learning#parameter efficiency#sample efficiency#adaptive spatial localization#model compression#cross-domain generalization2026년 9월 22일댓글 수 로딩 중
[논문리뷰] onPanda: Efficient Annotation of On-Policy Alignment Data for LLMs and Agents via Token-Level CorrectionLLM alignment 및 agent 학습을 위한 고품질 data 확보는 여전히 핵심적인 bottleneck입니다.#Review#Token-Level Correction#LLM Alignment#Agent Trajectories#On-Policy Data#Fine-grained Supervision#SFT Data#Multimodal Annotation2026년 9월 21일댓글 수 로딩 중
[논문리뷰] WorldCrafter: Consistent Video World Model with Implicit 3D-aware Memory비디오 월드 모델은 동적인 환경에서 인터랙티브 탐색을 가능하게 하지만, 긴 시간 범위(long horizons)와 다양한 시점(viewpoints)에 걸쳐 이전에 관찰된 내용을 일관되게 유지하는 데 어려움을 겪는다.#Review2026년 9월 21일댓글 수 로딩 중
[논문리뷰] Why Do Video Diffusion Models Violate Physics? Unveiling the Flaws in Attention Mechanisms최신 비디오 확산 모델들은 인상적인 시각적 품질에도 불구하고, 실제 물리 법칙을 위반하는 콘텐츠를 자주 생성하여 물리적 상식(Physical Commonsense)의 부족을 드러냅니다.#Review#Video Diffusion Models#Physical Commonsense#Attention Mechanisms#Interpretability#Motion Planning#Rotary Position Embedding (RoPE)#Text-to-Video2026년 9월 21일댓글 수 로딩 중
[논문리뷰] VideoGen-Agent: Reinforcing Video Generation Agents현재 비디오 생성 모델은 Photorealistic하고 Temporally Coherent한 비디오를 생성하는 데 큰 발전을 이루었지만, 생성된 비디오가 Prompt에 명시된 내용을 정확하게 표현하는 데는 한계가 있습니다.#Review#Video Generation#Multimodal Agents#Reinforcement Learning#Tool Use#Supervised Fine-Tuning#VABench#Agentic RL#Diffusion Models2026년 9월 21일댓글 수 로딩 중
[논문리뷰] UltraTex: Unleashing 2K Multi-View Diffusion for 3D Texturing본 논문은 3D Texturing 분야에서 기존 다중 뷰 확산 모델이 가진 해상도 제약 및 계산 복잡도 문제를 해결하기 위해 UltraTex를 제안한다. 기존 모델들은 512 또는 768 해상도에 머물러 있어 고해상도 참조 이미지의 정밀한 세부 정보를 보존하지 못하는 한계가 있다.#Review#3D Texturing#Multi-View Diffusion#Diffusion Transformer#Background Token Dropping#Block-Sparse Attention#High-Resolution Generation2026년 9월 21일댓글 수 로딩 중
[논문리뷰] Transferring the Intelligence of VLMs to Robotic Control본 논문은 VLM(Vision-Language Model)의 지능을 로봇 제어로 전이할 때 발생하는 핵심 문제를 해결하고자 합니다.#Review#Vision-Language Models (VLMs)#Robotic Control#Intelligence Transfer#In-Context Learning (ICL)#Semantic Action Interface#Closed-Loop Manipulation#Zero-Shot Learning#Few-Shot Learning2026년 9월 21일댓글 수 로딩 중
[논문리뷰] Think Like a World Model, Act Like a VLA: Distilling World-Model Representations into Compact Robot Policies본 논문은 Vision-Language-Action (VLA) 모델이 지닌 Robustness 한계를 극복하고자 한다.#Review#vision-language-action models#world models#knowledge distillation#representation learning#robot manipulation2026년 9월 21일댓글 수 로딩 중
[논문리뷰] The Functionalizer: Lossless Functional Decomposition for Subword Tokenization본 연구는 subword tokenizer가 겪는 vocabulary expansion(어휘 확장) 문제와 이로 인한 embedding space의 파편화를 해결하는 것을 목적으로 합니다.#Review#Subword Tokenization#Functional Decomposition#Opcode#Operand#Unicode Private Use Area#Lossless#Language Modeling2026년 9월 21일댓글 수 로딩 중
[논문리뷰] Streaming Video Editing with Easy Adaptation본 논문은 Bidirectional Diffusion Transformers(DiTs) 기반의 비디오 편집 기능을 재학습 없이 어떻게 스트리밍 환경으로 이전할 수 있는지에 대한 핵심 문제를 다룹니다 .#Review#Streaming Video Editing#Diffusion Models#Bidirectional-to-Streaming Transfer#Orthogonal Decoupled Training#Real-time Generation#Video Diffusion Transformers2026년 9월 21일댓글 수 로딩 중