[논문리뷰] Relax Within, Balance Across: Geometry-Guided Load Balancing for Vision-Language Mixture-of-Experts본 논문은 Vision-Language MoE 모델에서 토큰 혼합 비율(image-to-text ratio)이 변할 때 발생하는 부하 불균형 문제를 해결하고자 합니다.#Review#Mixture-of-Experts#Load Balancing#Vision-Language Models#Router Geometry#Composition Shift#Expert Parallelism2026년 8월 3일댓글 수 로딩 중
[논문리뷰] RecHarness: A Bandit-Routed Agentic Harness for Self-Evolving Recommender Systems본 논문은 추천 시스템 개발 과정에서 반복적인 수동 엔지니어링 작업이 소요되는 문제를 자동화된 방식으로 해결하고자 합니다.#Review#Recommender Systems#Agentic Harness#Bandit-Routed Optimization#LLM-based MLE#Thompson Sampling#Self-Evolving2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Progressive Agent Skill Generation via Reinforcement Learning본 연구는 LLM 에이전트가 외부 스킬을 통해 복잡한 태스크를 수행할 때 발생하는 자동화된 고품질 스킬 생성의 어려움을 해결하고자 합니다.#Review#LLM Agents#Reinforcement Learning#Skill Generation#Rollback Reward#Progressive Editing#GRPO#Agentic Workflow2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Poplar: A Scalable Pipeline for Human-Centric Image Dataset Synthesis본 논문은 기존의 개별 이미지 생성 방식을 넘어, 대규모 human-centric 데이터셋을 구축할 때 발생하는 의미적 일관성 및 품질 관리 문제를 해결하고자 합니다.#Review#Dataset Synthesis#Human-Centric Photography#Diffusion Models#Prompt Engineering#Vision-Language Models#Data Quality Control2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Motion Beyond Morphology: Bootstrapping Cross-Category Motion Transfer from Abstract Motion Representations본 논문은 상이한 형태, 관절, 변형 기작을 가진 객체 간의 모션 전이(Motion Transfer)가 고정된 구조적 대응 관계를 가정하는 기존 모델들에서 왜곡되거나 불가능해지는 문제를 해결하고자 합니다.#Review#Motion Transfer#Open-Category#Multi-Granularity#Abstract Motion Representation#Cross-Category#Bootstrapping#Diffusion Models2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures본 논문은 Agentic 시스템의 Failure가 발생했을 때, 이를 해결하기 위한 명확한 수정 지점을 찾기 어렵다는 Repair-Assignment 문제를 해결하고자 합니다.#Review#Agentic AI#Failure Taxonomy#Root-cause Analysis#Agentic System#Failure Localization#Interaction-Centric#Evaluation2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Loud or Silent? A Reusable Framework for Per-Modality Failure Analysis in Multimodal Clinical AI본 논문은 다중 모달리티 기반 임상 AI 모델이 실제 배포 환경에서 모달리티 누락(Missing Modality) 상황에 직면했을 때 발생하는 예측 불확실성을 체계적으로 분석하고자 한다.#Review#Multimodal AI#Clinical AI#Failure Analysis#Modality Dropout#LVEF#HFrEF#Frozen Embedding2026년 8월 3일댓글 수 로딩 중
[논문리뷰] LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks본 논문은 기존의 에이전트 하네스가 긴 작업(long-horizon task)을 수행할 때 발생하는 일관성 저하와 신뢰성 문제를 해결하고자 합니다.#Review#Long-Horizon Agents#Task-State Management#Manage-Execute-Audit (MEA)#AgentAdapter#Computer Use#System Robustness2026년 8월 3일댓글 수 로딩 중
[논문리뷰] LeapTalk: Breaking the Latency-Quality Trade-off in Talking Head Generation본 논문은 기존 talking-head generation 분야가 직면한 latency와 generation quality 사이의 근본적인 trade-off 문제를 해결하는 것을 목표로 합니다.#Review#Talking Head Generation#Brownian Bridge#Distribution Matching Distillation#Streaming Generation#Real-time#Latency-Quality Trade-off2026년 8월 3일댓글 수 로딩 중
[논문리뷰] ICDAR 2026 Competition on Information Extraction from Atomic Layer Deposition/Etching (ALD/E) Scientific Figures본 연구는 과학 논문 내 도표가 복잡한 시각적 정보와 도메인 특화 지식을 내포하고 있음에도 불구하고, 기존 Multimodal AI 모델들이 이를 충분히 이해하고 추론하지 못하는 문제를 해결하고자 합니다.#Review#Multimodal AI#Atomic Layer Deposition#Scientific Figure Comprehension#Benchmark Dataset#Visual Question Answering#Data Extraction2026년 8월 3일댓글 수 로딩 중
[논문리뷰] GradCuit: Credit-Assigned Gradient Flow Enables Robust and Interpretable Test-Time Latent Reasoning본 논문은 기존 test-time latent reasoning 방식들이 겪는 구조적 한계인 불투명한 credit assignment 문제를 해결하고자 한다.#Review#Test-Time Reasoning#Latent Space#Gradient Flow#Transformer Circuits#Credit Assignment#Robustness2026년 8월 3일댓글 수 로딩 중
[논문리뷰] GPTQ-2D: Cubic-Time Two-Sided Adaptive Rounding본 연구는 GPTQ와 같은 기존의 one-sided adaptive rounding 기법이 좌우 양측에 가중치가 존재하는 행렬 연산(two-sided rounding)에 적용될 때 발생하는 연산 복잡도 문제를 해결하는 것을 목적으로 합니다.#Review#Adaptive Rounding#GPTQ#Kronecker Product#Two-Sided Metric#Matrix Quantization#Cubic-Time Complexity2026년 8월 3일댓글 수 로딩 중
[논문리뷰] GEOID-Flood: A Large-Scale Multi-Modal Benchmark Dataset for Flood Segmentation본 연구는 홍수 매핑을 위한 기존 데이터셋들이 가진 규모의 한계, 센서의 다양성 부족, 그리고 영구적 수역과 일시적 홍수 분할의 불명확성 문제를 해결하고자 한다 .#Review#Flood Segmentation#Multi-Modal#Benchmark Dataset#Geospatial Foundation Models#Synthetic Aperture Radar (SAR)#Sentinel-1#Sentinel-22026년 8월 3일댓글 수 로딩 중
[논문리뷰] DreamTraj: Generating 6-DoF Object Trajectories by Reading Unrendered Video Diffusion Latents본 논문은 단일 RGB 이미지와 텍스트 명령(instruction)만을 사용하여 물체의 미래 6-DoF 궤적을 예측하는 문제를 해결합니다.#Review#6-DoF Trajectory#Video Diffusion Models#Embodied AI#Implicit Motion Generation#Flow-Matching#Egocentric Manipulation2026년 8월 3일댓글 수 로딩 중
[논문리뷰] DiffusionGemma Technical Report본 논문은 기존 Autoregressive(AR) 모델이 가진 엄격한 순차적 생성 방식의 메모리 병목 현상을 해결하기 위해 DiffusionGemma를 제안합니다.#Review#DiffusionGemma#Discrete Diffusion#Autoregressive Model#Inference Efficiency#Pareto Frontier#Adaptive Stopping#Sampler Distillation2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs본 논문은 최신 Vision-Language-Action(VLA) 모델들이 Chain-of-Thought(CoT) Supervision 과정에서 GT 궤적에 과도하게 의존하여 발생하는 인과적 불충실성(causal unfaithfulness) 문제를 해결하고자 합니다.#Review#Autonomous Driving#Vision-Language Models#Chain-of-Thought#Trajectory Anchoring Bias#Verifiable Reasoning#Reinforcement Learning2026년 8월 3일댓글 수 로딩 중
[논문리뷰] DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents본 논문은 기존의 MLLM 기반 검색 에이전트가 지닌 고정된 파라미터 지식의 한계와 복잡한 장기적(long-horizon) 검색 과제에서의 부적합성을 해결하고자 합니다.#Review#Multimodal Large Language Models#Long-Horizon Search#Vision-in-the-Loop#Multimodal Event Graph#Active Visual Acquisition#Agentic Workflow2026년 8월 3일댓글 수 로딩 중
[논문리뷰] DAPD: Dual-Anchored Policy Distillation본 논문은 OPSD 과정에서 발생하는 Privilege Illusion 문제를 해결하기 위해 고안되었습니다. 기존 연구들은 privileged information을 직접 활용하거나, 교사 신호를 선별적으로 재가중하는 방식을 취했으나, 이는 근본적인 정보 비대칭성을 해결하지 못하는 한계가 있습니다 .#Review#Policy Distillation#Language Model Post-training#Information Asymmetry#Privilege Illusion#Reasoning Models#On-policy Distillation2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Compute Globally, Materialize Locally: The Memory Contract of Sparse Event-KV본 연구는 장기 기억을 사용하는 LLM 기반 에이전트에서 KV cache를 선별적으로 삭제하는 Eviction 정책의 유효성을 검증하고자 한다.#Review#Sparse KV-Cache#Semantic Materialization#Long-Horizon Agents#Event-KV Serving#Donor-Pair Analysis#Contextual Computation2026년 8월 3일댓글 수 로딩 중
[논문리뷰] CADENA: Stepwise CAD Reverse Engineering본 연구는 기존 CAD 복원 연구들이 전체 프로그램을 단일 패스(Single-pass)로 생성하여 중간 형상을 검토하지 못하는 구조적 한계를 해결하고자 합니다 .#Review#CAD Reverse Engineering#Parametric CAD#Vision-Language Models#Stepwise Generation#Geometric Feedback#Reinforcement Learning2026년 8월 3일댓글 수 로딩 중