[논문리뷰] MMMMM: A Unified Taxonomy for Investigating the Mechanisms of Multilingual MultiModal Misinformation본 논문은 다중 모달 허위 정보의 메커니즘을 명확히 규명하고, 이를 대규모로 자동 분석할 수 있는 체계적인 방법론이 부재하다는 문제 의식에서 출발합니다. 기존 연구들은 각기 다른 소규모 데이터셋에 의존하거나, 불분명하고 파편화된 분류 체계를 사용하여 실질적인 대응책 마련에 한계가 있었습니다.#Review#Multimodal Misinformation#Taxonomy#Vision-Language Models#Social Media#Community Notes#Annotation Pipeline#Fact-checking2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling본 논문은 실내 장면의 Composable Scene Modeling 과정에서 기존 파이프라인이 가진 엄격한 입력 의존성 문제를 해결하고자 한다.#Review#Composable Scene Modeling#Real-to-Sim#Scene Graph#Amodal Object Asset Generation#GizmoAct#3D Grounding#VLM Policy2026년 8월 31일댓글 수 로딩 중
[논문리뷰] LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation본 논문은 현대의 VLM이 이미 우수한 공간 추론 능력을 갖추고 있음에도 불구하고, 기존의 로봇 네비게이션 시스템은 여전히 태스크나 Embodiment별로 파편화된 구조를 가지고 있다는 문제에서 출발합니다 .#Review#Embodied Navigation#Vision-Language Models#Generalist Model#Spatial Intelligence#Residual Vector-Quantization#Dual-Channel Pointing#Embodied AI2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Lies We Can See: Joint Verbal and Non-Verbal Deception by VLM Agents in Embodied Social Interactions본 논문은 기존의 사회적 추론(Social-deduction) 게임 연구가 텍스트 기반 환경에 국한되어 있어, 기만 전략의 핵심인 비언어적 sensorimotor 채널을 완전히 포착하지 못한다는 문제점을 해결하고자 합니다.#Review#VLM Agents#Strategic Deception#Embodied AI#Social Deduction#Multi-Agent System#Ablation Study2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Learning to Evaluate Before Improving: Automatic Rubric Induction for Automatic Research AgentsAutonomous scientific research agents는 literature review, data analysis, experimentation, report generation 등 end-to-end scientific workflows에 점차 적용되고 있습니다.#Review#Autonomous Agents#Rubric Induction#Scientific Research#LLM Evaluation#Iterative Revision#Evidence Grounding#Task-Specific Guidance2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Keep-or-Drop? Adaptive Tokenizer for Compact Video Representation본 논문은 비디오 데이터의 강한 시공간적 중복성(Spatio-temporal redundancy)을 기존 VAE가 효율적으로 활용하지 못한다는 문제에서 출발합니다. 기존 OmniTokenizer와 같은 고정 길이 토큰화 방식은 영상의 복잡도와 무관하게 고정된 압축 비율을 사용하여 연산 자원을 낭비합니다.#Review#VAE#Adaptive Tokenization#Video Diffusion Model#Token Sparsity#Cascaded Generation#Spatio-temporal Redundancy2026년 8월 31일댓글 수 로딩 중
[논문리뷰] GenFirst: Generation Before Reconstruction for Stable End-to-End Latent Generative Modeling본 논문은 VAE와 생성 모델을 직접적으로 통합하는 End-to-End 학습 과정에서 발생하는 Latent Collapse 문제와 최적화 불균형을 해결하고자 합니다.#Review#Latent Generative Models#End-to-End Training#Latent Collapse#Generation-Reconstruction Conflict#Flow Matching#Autoregressive Models2026년 8월 31일댓글 수 로딩 중
[논문리뷰] EvoGenUI-Bench: Evaluating LLMs as Multi-Turn Generative UI Assistants본 논문은 LLM이 생성한 인터페이스가 사용자의 진화하는 요구사항을 따라가지 못하고 기능이 파손되는 문제를 해결하기 위해 EvoGenUI-Bench를 제안한다.#Review#Generative UI#Multi-turn Interaction#Benchmark#Executable Artifacts#Evidence-Grounded Evaluation#LLM Assistants2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Evaluating the Hidden Costs of Personalization in Large Language Models본 논문은 LLM의 Personalization 기능이 사용자 유용성과 편의성을 향상시키는 반면, 대화 기록, 추론된 선호도, 사용자 프로필 등 개인 Context에 조건화될 때 균형 잡히고 유익한 응답 제공에서 사용자 만족도 최적화로 전환되는 과정에서 발생하는 숨겨진 비용과 부작용을 체계적으로 평가합니다.#Review#Personalization#LLM#Irrelevant Personalization#Preference Narrowing#Sycophantic Bias#Evaluation Framework#PRISK#Behavioral Bias2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Dynamic Important Example Mining for Reinforcement Finetuning본 논문은 RFT 과정에서 데이터의 가치를 정적으로 가정하는 기존 방식의 한계를 극복하기 위해 제안되었습니다.#Review#Reinforcement Fine-Tuning#Dynamic Data Selection#Gradient Alignment#Policy Optimization#Curriculum Learning2026년 8월 31일댓글 수 로딩 중
[논문리뷰] DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution기존 비디오 생성 모델들은 시각적 충실도와 모션 품질에서 상당한 발전을 이루었지만, 오디오를 생략하거나 별도의 단계에서 합성하는 경우가 많아 시각적 역동성과 음향 이벤트 간의 상호 모델링이 제한적이라는 핵심적인 문제에 직면해 있다.#Review#Native Audio-Video Generation#Gated Cross-Modal Attention#Reinforcement Learning#2K Refinement#Open-Weight Model#Multimodal Feedback2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement본 논문은 On-Policy Distillation (OPD)의 Teacher Supervision 신호가 off-policy context에서 본질적으로 noisy하며, 이러한 노이즈가 학생 모델의 성능 향상에 미치는 영향이 불분명하다는 문제를 제기한다.#Review#On-Policy Distillation#Self-Adaptation#Reinforcement Learning#LLM#Token-level Supervision#Entropy-adaptive Advantages#Mathematical Reasoning2026년 8월 31일댓글 수 로딩 중
[논문리뷰] DICS: Exploring Data Intrinsic Consistency for Visual Instruction Selection본 논문은 급격히 팽창하는 Visual Instruction Tuning 데이터셋 내에서 학습 품질을 극대화할 수 있는 최적의 샘플 선택 문제를 해결합니다.#Review#Visual Instruction Tuning#Data Selection#Data Intrinsic Consistency#Vision-Language Models#Information Gain#Multimodal Alignment#Budget-aware Selection2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Cross-lingual Functional Vectors for Emotion Detection in Large Language Models본 연구는 LLM의 In-Context Learning (ICL) 능력이 언어 간 범용적인 태스크 표현으로 전이될 수 있는지, 그리고 복잡한 의미론적 태스크에서 Functional Vectors (FVs)가 효과적인지를 검증한다.#Review#Functional Vectors#Large Language Models#Emotion Detection#Cross-lingual Transfer#Mechanistic Interpretability#In-Context Learning2026년 8월 31일댓글 수 로딩 중
[논문리뷰] ContextBias: Controlled Evaluation of Bias Persistence Under Context Shift in Text-to-Image Models본 논문은 Text-to-Image(T2I) 모델이 학습한 직업 관련 시각적 연관성(Role-attribute association)이 다양한 문맥(Context) 변화 속에서도 얼마나 안정적으로 유지되는지, 혹은 변화하는지를 규명하고자 합니다.#Review#Text-to-Image#Bias Persistence#Contextual Variation#ContextBench#Stereotypical Bias#Compositional Generalization#Attribute Extraction2026년 8월 31일댓글 수 로딩 중
[논문리뷰] CogEvol: Towards Efficient and Reliable Learning Environment Generation본 연구는 고품질 교육용 학습 환경(Slides 및 Interactive HTML)을 효율적이고 신뢰성 있게 자동 생성하는 문제를 해결하고자 합니다.#Review#Learning Environment Generation#Interactive HTML#Structured JSON Slides#Reinforcement Learning#Production-Grounded Data Pipeline#Scaffold Editing2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Chat-Edit-3D++: Interactive 3D and 4D Scene Editing via Large Language Models기존의 text-driven 3D scene editing 방식들은 고정된 input patterns에 의존하며, 단일 또는 소수의 2D visual models에 의해 editing capabilities가 제한되는 단점을 가지고 있다.#Review#3D scene editing#4D scene editing#Large language models#Vision-Language models#Hash-Atlas#Workflow Decoupling#Trajectory-tuning#Dialogue System2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Chain-of-Thought Faithfulness of Reasoning Models Varies with Where and How Preference Cues Are Delivered본 연구는 Chain-of-Thought(CoT)가 모델의 답변을 형성하는 정보를 충실하게 기록하고 있다는 가정이 에이전트 시스템 환경에서 유효한지 검증한다.#Review#Chain-of-Thought#Faithfulness#Agentic Systems#FACE-Eval#Preference Cues#Verbalized Commitment#Unverbalized Adoption2026년 8월 31일댓글 수 로딩 중
[논문리뷰] CAST: Critique-Aware Supervision for Training Reliable Long-Horizon Tool-Calling Agents본 논문은 장기적인 상호작용 환경에서 LLM 에이전트의 Reliability가 심각하게 저하되는 문제를 해결하고자 한다 . 기존 에이전트는 복잡한 태스크 수행 중 사소한 실수로 인해 연쇄적인 실패를 경험하며, 일단 발생한 오류는 수정이 어려운 경우가 많다.#Review#LLM Agents#Tool-Calling#Critique-Aware Training#Long-Horizon#Reliability#Agentic Verification#Policy Optimization2026년 8월 31일댓글 수 로딩 중
[논문리뷰] BLARM: Animating 3D Objects from Video via Blending Latent Rigid Motion Primitives본 논문은 monocular video로부터 3D mesh를 고품질로 애니메이션화하기 위한 rig-free 프레임워크인 BLARM을 제안한다.#Review#3D Mesh Animation#Rig-free Animation#Latent Rigid Motion Primitives#Linear Blend Skinning#Video-driven Generation#Spatiotemporal Attention2026년 8월 31일댓글 수 로딩 중