[논문리뷰] RestoreKV: Recovering Full-Cache Behavior Under Aggressive Query-Agnostic KV Cache Eviction본 논문은 query-agnostic KV 캐시 압축 환경에서 발생하는 성능 급락 문제를 해결하고자 합니다. 기존 연구들은 주로 중요한 KV 쌍을 선별(Selection)하는 데 집중했으나, 압축률이 높아질수록 선별된 정보만으로는 모델 성능을 유지하기 어렵습니다.#Review#KV Cache Eviction#Query-Agnostic#LoRA#Self-Distillation#Long-Context LLM#Context Reconstruction2026년 8월 4일댓글 수 로딩 중
[논문리뷰] Quo Vadis, World Modeling?본 논문은 기존의 World Model이 단순히 미래의 물리적 상태를 예측하는 데 머물러 있어, 자율적으로 성장하고 지속적으로 개선되어야 하는 현대 Agent의 요구를 충분히 충족하지 못한다는 문제를 제기한다.#Review#World Models#World Proxies#Agent-Centric#Information Transition#Continual Improvement#Inference-Time Guidance#Training-Time Optimization#Co-Evolution2026년 8월 4일댓글 수 로딩 중
[논문리뷰] Push-Wiper: Toward General-Purpose Robotic Cleaning across Varied Stains and Surfaces with Segmented Pushing Trajectories본 논문은 점성이 높은 Viscous Stains를 제거하는 과정에서 발생하는 2차 오염 문제를 해결하기 위해 제안되었습니다. 기존의 닦기(Wiping) 방식은 오염물을 넓게 퍼뜨리는 경향이 있고, 문지르기(Scrubbing)는 표면 손상 위험이 커 정밀한 제어가 필요하다는 한계가 있습니다.#Review#Robotic Cleaning#Diffusion Policy#Viscous Stains#Trajectory Planning#Hybrid Force-Position Control#Zero-shot Generalization2026년 8월 4일댓글 수 로딩 중
[논문리뷰] PosterMELD: Multi-Agent Paper-to-Poster Generation for Controllable Design Diversity with Editable Print-Ready Outputs본 논문은 기존 자동화 포스터 생성 시스템들이 가진 출력물의 인쇄 적합성(print-readiness) 부족과 원본 편집 불가능(non-editable) 문제를 해결하기 위해 PosterMELD를 제안한다.#Review#Scientific Poster Generation#Multi-Agent System#Print-Ready Rate#Editable Output#Template-Conditioned#Controllable Design Diversity2026년 8월 4일댓글 수 로딩 중
[논문리뷰] PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning본 논문은 LLM agent의 다회차 상호작용 환경에서 발생하는 보상 희소성(reward sparsity)과 teacher guidance의 신뢰성 저하 문제를 해결하고자 합니다.#Review#Agentic Reinforcement Learning#On-Policy Self-Distillation#Teacher Reliability#Persistent Consistency#Adaptive Aggregation#Token-level Weighting#Multi-turn Interaction2026년 8월 4일댓글 수 로딩 중
[논문리뷰] PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents본 연구는 개인용 AI 에이전트의 발전 과정에서 나타나는 Online Self-Evolution 능력을 체계적으로 평가하고, 실제 개선이 일어나는지 검증하는 것을 목표로 합니다 .#Review#Recursive Self-Improvement#Personal Agents#Performance-Attribution#Online Self-Evolution#Benchmark#Persistence Mechanisms#Agent Framework2026년 8월 4일댓글 수 로딩 중
[논문리뷰] OmniPack: Unified Token Compression for Efficient Omni-modal Large Language Models본 연구는 Omni-LLMs가 장문의 오디오-비주얼 입력 시 발생하는 방대한 계산 및 메모리 오버헤드 문제를 해결하고자 합니다.#Review#Omni-modal Large Language Models#Token Compression#Efficient Inference#Multimodal Understanding#Training-free Framework#Audio-visual Collaboration2026년 8월 4일댓글 수 로딩 중
[논문리뷰] Multi-Task Multi-Frame Visual Piano Transcription본 논문은 오디오 기반 AMT가 서스테인 페달로 인해 발생하는 물리적 건반 상태와 실제 소리 종료 시점 간의 괴리 문제를 해결하고자 하는 시도에서 출발합니다. 기존의 오디오 시스템은 페달로 인해 연주 종료가 지연되어 실제 물리적 키 릴리즈를 반영하지 못하는 한계가 있습니다.#Review#Visual Piano Transcription#Multi-task Learning#Conformer#MIDI Transcription#Computer Vision#Key Mechanics2026년 8월 4일댓글 수 로딩 중
[논문리뷰] MiniWorld: Democratizing the Training of Video World Models from Scratch본 논문은 대규모 컴퓨팅 자원 없이도 스트리밍 비디오 월드 모델을 학습할 수 있는 투명하고 재현 가능한 베이스라인을 제공하는 것을 목표로 합니다.#Review#Video World Models#Streaming Inference#Diffusion Transformer#Flow Matching#Block-Causal Attention#Autoregressive Generation2026년 8월 4일댓글 수 로딩 중
[논문리뷰] MerchantBench: Benchmarking LLM Agents for Long-Term Coherence in E-Commerce Operations본 논문은 기존의 LLM Agent 벤치마크들이 단기적인 작업 완수나 즉각적인 피드백 기반의 태스크에 편향되어 있다는 문제를 해결하고자 한다. 실제 환경에서는 상점 운영과 같이 장기적인 전략 수립이 필요하며, 과거의 의사결정이 미래의 선택을 제약하고 피드백이 불균일하게 발생하는 복합적인 상황이 빈번하다.#Review#LLM Agents#Long-Term Coherence#E-Commerce#Order-Level Simulation#Partially Observable Markov Decision Process#Benchmark2026년 8월 4일댓글 수 로딩 중
[논문리뷰] LLaDA MoE v2: Scaling Mixture-of-Experts Diffusion Language Models본 논문은 대규모 MoE 기반 dLLM의 최적 Scaling 행동과 아키텍처 설계 원칙이 기존 AR 모델과는 다르다는 점을 지적하며, 이를 체계적으로 정립하고자 합니다.#Review#Diffusion Language Models#Mixture-of-Experts#Scaling Laws#Compute-Optimal#LLaDA#Sparse Activation2026년 8월 4일댓글 수 로딩 중
[논문리뷰] Knowledge-Geometry Decoupling: Refreshable Pretrained Transfer for Streaming Recommendation본 논문은 산업계 추천 시스템에서 발생하는 Data Distribution Drift 환경 하의 사전 학습-전이(pretrain-then-transfer) 패러다임이 가진 근본적인 한계를 해결하고자 합니다.#Review#Streaming Recommendation#Pretrained Transfer#Knowledge–Geometry Decoupling#Behavioral Multi-Token Prediction#Anchored Calibration Residual2026년 8월 4일댓글 수 로딩 중
[논문리뷰] JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion본 논문은 실시간 스트리밍 환경에서 높은 품질과 시간적 일관성을 유지하며 비디오를 편집하는 핵심 문제를 해결하고자 합니다.#Review#Autoregressive Diffusion#Real-Time Video Editing#Streaming Inference#Source-Anchored Distribution Matching Distillation#Long-Horizon Autoregressive Distillation#Causal Generation#Video-to-Video2026년 8월 4일댓글 수 로딩 중
[논문리뷰] Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and EditingUnified 3D modeling은 scarce multimodal data, 특히 large-scale이고 geometrically consistent한 editing data의 부족으로 인해 여전히 제한적이다.#Review#Unified Multimodal Model#3D Generation#3D Understanding#3D Editing#Part Generation#Diffusion Models#Vision-Language Model#Large-scale Data2026년 8월 4일댓글 수 로딩 중
[논문리뷰] GROVE: Growing and Reasoning over Temporally Stratified Memory from Streaming Video Experience본 논문은 웨어러블 비디오 어시스턴트가 reactive 질문 응답과 proactive 서비스를 동시에 수행하기 위해 필요한 장기 기억 관리의 한계를 해결하고자 한다.#Review#Streaming Video#Long-term Memory#Temporal Stratification#Proactive Assistance#Agentic Retrieval#Multimodal Lifelong Understanding2026년 8월 4일댓글 수 로딩 중
[논문리뷰] ExplainBench: Evaluating Code Explanations from Agents본 논문은 LLM 에이전트가 생성하는 코드 설명(Explanation)의 신뢰성을 검증할 수 있는 객관적인 평가 기준이 부재하다는 문제점을 지적합니다. 에서 볼 수 있듯이, 에이전트의 설명은 그럴듯해 보이지만 실제 패치는 테스트 코드조차 통과하지 못하는 등 설명과 실제 동작 간의 불일치(Mismatch)가 발생합니다.#Review#LLM agents#explainability#benchmark#trustworthiness#software engineering#code explanation#evaluation framework2026년 8월 4일댓글 수 로딩 중
[논문리뷰] Decoding Children's Gait Behavior본 논문은 아동의 보행 이상을 정밀하게 분석하기 위한 자동화된 컴퓨터 비전 프레임워크가 부재하다는 문제를 해결하고자 합니다. 기존의 3D 모션 캡처 시스템은 고가의 장비와 넓은 공간이 필요하여 임상 현장에서의 보급이 어렵고, IMU 센서 기반 방식은 아동의 자연스러운 움직임을 저해할 수 있습니다.#Review#Pediatric Gait#Visual Gait Score#Foundation Models#CGV Dataset#ChildGait-Video#Clinical Gait Analysis2026년 8월 4일댓글 수 로딩 중
[논문리뷰] ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities?본 논문은 LLM 에이전트가 외부 스킬 라이브러리를 활용할 때, 자율적으로 자신의 스킬을 효과적으로 진화시키고 확장할 수 있는지에 대한 의문을 제기합니다.#Review#LLM Agents#Continual Learning#In-Context Learning#Skill Evolution#Agentic Benchmarking#Skill Library2026년 8월 4일댓글 수 로딩 중
[논문리뷰] ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels본 논문은 기존의 역사적 언어 변화 연구들이 서로 다른 데이터셋과 측정 방식을 사용하여 morphology, syntax, semantics, pragmatics 간의 상관관계를 직접 비교할 수 없다는 문제점을 해결하고자 합니다.#Review#Language Change#Sparse Autoencoders#Crosscoders#Diachronic Analysis#Multilingual Language Models#Interpretability#Linguistic Levels2026년 8월 4일댓글 수 로딩 중
[논문리뷰] CAPEval: A Decoupled Caption Evaluation across Understanding and Generation기존의 Caption Quality Evaluation 방식은 Caption 품질을 단일 Scalar Objective로 간주하여, Caption이 담는 Visual information의 범위(Coverage)와 주장하는 내용의 Factual correctness (Precision)라는 두 가지 distinct property를 혼동하는 문제점을 안고 있었다.#Review#Caption Evaluation#Multimodal Understanding#Text-to-Image Generation#Coverage#Precision#Downstream Utility#Vision-Language Models#Dataset Curation2026년 8월 4일댓글 수 로딩 중