[논문리뷰] K12-KGraph: A Curriculum-Aligned Knowledge Graph for Benchmarking and Training Educational LLMs본 논문은 기존 교육 벤치마크들이 LLM의 단순한 '사실 회상(factual recall)' 능력만을 측정할 뿐, 교육 과정의 구조적 이해인 Curriculum Cognition을 간과하고 있다는 문제를 제기한다 .#Review#Educational LLMs#Knowledge Graph#Curriculum Cognition#Instruction Tuning#Multimodal Learning#K-12 Education2026년 7월 23일댓글 수 로딩 중
[논문리뷰] GraphVid: Interactive Graph-Controllable Video GenerationGraphVid는 기존의 trajectory-based 혹은 단순 텍스트 기반 비디오 생성 모델이 가진 복잡한 다중 객체 상호작용 제어의 어려움을 극복하기 위해 제안되었습니다.#Review#Graph-Controllable Video Generation#Scene Graphs#Edge-Aware Graph Reasoning#Interaction-Centric#Diffusion Transformer#LoRA#LTX-Video2026년 7월 23일댓글 수 로딩 중
[논문리뷰] FinanceComplexQA: Benchmarking Agentic Reasoning on Industrial-grade Financial Documents본 논문은 금융 도메인에서 LLM 기반 시스템의 복잡한 추론 능력을 평가할 수 있는 신뢰성 있는 벤치마크의 부재 문제를 해결하고자 한다. 기존의 금융 QA 벤치마크들은 주로 단편적인 데이터나 단순화된 표 해석에 집중하여, 실제 금융 현장의 복잡한 문서 구조와 고도화된 분석 요구사항을 충분히 반영하지 못하는 한계가 있다.#Review#Agentic Reasoning#Financial Document QA#Benchmark#Finance-LaTeX#Dual-Context Reasoning#Cross-Layout Reasoning#RAG#Agent-as-a-Judge2026년 7월 23일댓글 수 로딩 중
[논문리뷰] Color Pass-Through via Camera-Display Coupling본 논문은 실세계 장면을 카메라로 캡처하여 디스플레이로 볼 때 발생하는 색상, 밝기, 대비의 왜곡 문제를 해결하고자 합니다.#Review#Color Pass-Through#Camera-Display Coupling#Metamerism#Color Constancy#End-to-End Optimization#Computational Photography2026년 7월 23일댓글 수 로딩 중
[논문리뷰] AREX: Towards a Recursively Self-Improving Agent for Deep Research본 논문은 심층 연구(Deep Research) 과정에서 발생하는 정보 탐색과 검증 간의 불균형 및 장기 탐색의 효율성 문제를 해결하고자 합니다 . 기존 연구 시스템은 단순한 탐색 시간 확장이나 문맥 누적에 의존하여, 초기 단계의 오류가 증폭되거나 중복된 탐색이 반복되는 한계가 있습니다.#Review#Deep Research#Recursively Self-Improving#Agentic Mid-training#Reinforcement Learning#Context-Update#Discovery-Verification Asymmetry2026년 7월 23일댓글 수 로딩 중
[논문리뷰] Train the Model, Not the Reader: Decodability Supervision for Verifiable Activation Explanations본 논문은 현재의 NLA가 모델의 내부 상태를 해석하는 데 있어 '충실도(Faithfulness)'를 보장하지 못한다는 구조적 결함을 해결하고자 합니다. 기존 연구들은 Reconstruction 점수를 신뢰성 지표로 사용하지만, 저자들은 이 점수가 실제 모델의 내부 정보를 정확히 반영하지 않는다는 점을 증명합니다.#Review#Natural-Language Autoencoders#Activation Explanations#RECAP#Faithfulness#Decodability Supervision#AI Safety2026년 7월 22일댓글 수 로딩 중
[논문리뷰] Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning본 논문은 기존의 시각적 추론 학습 방식이 대규모 데이터셋에 의존하거나 특정 도메인에 국한되어, 범용적이고 재현 가능한 추론 데이터의 부족이라는 한계에 직면해 있음을 지적합니다. 특히 복잡한 시각적 과제에서 학습 데이터의 다양성과 정확한 검증 가능성을 동시에 확보하는 것이 현재 VLM 연구의 핵심 병목 구간입니다 .#Review#Visual Reasoning#Reinforcement Learning#Verifiable Rewards#Multidomain#Taxonomy-Guided#Procedural Generation2026년 7월 22일댓글 수 로딩 중
[논문리뷰] Self Gradient Forcing: Native Long Video Extrapolation본 논문은 Autoregressive Video Diffusion 모델에서 장시간 영상 생성 시 발생하는 일관성 저하 문제를 해결하고자 합니다.#Review#Autoregressive Video Diffusion#Self Gradient Forcing#Historical Context-Gradient Gap#DMD#Long-Horizon Extrapolation#KV Cache#Two-pass Training2026년 7월 22일댓글 수 로딩 중
[논문리뷰] SeededGrasp: Language-Guided Grasping in Complex Scenes with Multiple Embodiments본 논문은 복잡한 클러터(Cluttered) 환경에서 언어 명령에 기반한 다중 실시체 파지 생성의 한계점을 해결하고자 합니다. 기존 연구들은 대규모 데이터셋과 고비용의 End-to-End 학습이 필요하거나, 복잡한 포즈 최적화 파이프라인에 의존하여 실시간성 및 일반화 성능이 부족하다는 문제가 있습니다.#Review#Dexterous Grasping#Natural Language#Multi-Embodiment#Flow Matching#Vision-Language Models#Robotic Manipulation2026년 7월 22일댓글 수 로딩 중
[논문리뷰] Scaling Laws for Hypernetwork-Based Knowledge Injection in Large Language Models본 논문은 LLM에 대한 대규모 사실적 지식 주입의 신뢰성 및 확장성 문제를 해결하기 위해 Hypernetwork 기반 접근 방식을 제안합니다. 기존의 full fine-tuning이나 PEFT는 지식 주입 시 catastrophic forgetting과 OOD 일반화 부족이라는 한계를 지니고 있습니다.#Review#Hypernetworks#Knowledge Injection#Scaling Laws#Large Language Models#MegaWikiQA#Out-of-Distribution#LoRA2026년 7월 22일댓글 수 로딩 중
[논문리뷰] SLPO: Scaling Latent Reasoning via a Surrogate Policy본 연구는 latent reasoner가 명시적 CoT와 달리 결과 기반 RLVR을 활용한 test-time scaling의 이점을 누리지 못하는 문제를 해결하고자 한다.#Review#Latent Reasoning#Reinforcement Learning#Test-Time Scaling#Surrogate Policy#Adaptive Computation#Outcome-Reward RL2026년 7월 22일댓글 수 로딩 중
[논문리뷰] SLAM in Low-Light Environments: Project Report본 연구는 극심한 저조도 환경에서 기존 Visual SLAM 시스템의 낮은 신뢰성 문제를 해결하고자 한다. 대다수의 기존 SLAM 벤치마크는 조명이 충분한 실내 또는 주간 실외 환경에 집중되어 있어, 야간, 동굴, 또는 재난 현장과 같은 저조도 환경에서의 운영 능력은 검증되지 않았다.#Review#SLAM#Low-Light#Visual-Inertial#Feature-based SLAM#Localization#Mapping#Autonomous Navigation2026년 7월 22일댓글 수 로딩 중
[논문리뷰] SLAI T-Rex: Full-Parameter Post-training of the DeepSeek-V4 Family on Ascend SuperPOD본 연구는 trillion-parameter 규모의 MoE 모델인 DeepSeek-V4를 Ascend SuperPOD 클러스터에서 학습할 때 발생하는 시스템적 병목 현상을 해결하고자 합니다.#Review#SLAI T-Rex#Ascend SuperPOD#DeepSeek-V4#Operations Research#AuraKernel#Full-Parameter Post-training2026년 7월 22일댓글 수 로딩 중
[논문리뷰] Generalizable VLA Finetuning via Representation Anchoring and Language-Action Alignment본 연구는 VLA 파인튜닝 시 발생하는 고질적인 성능 저하 문제를 해결하기 위해 Anchor-Align을 제안합니다.#Review#Vision-Language-Action Models#Robot Manipulation#Catastrophic Forgetting#Language-Action Alignment#Out-of-Distribution Generalization#Behavior Cloning2026년 7월 22일댓글 수 로딩 중
[논문리뷰] G-MAD: A Game-Based Data Generation Framework for Multi-View RGB-T Aerial Object Detection본 연구는 항공 이미지 환경에서 RGB-T 객체 탐지를 수행할 때 직면하는 데이터 부족과 고비용 문제를 해결하기 위해 제안되었다. 기존의 항공 데이터셋 구축은 복잡한 환경에서 다수의 비행 및 Annotation 작업이 수반되어야 하므로 Viewpoint 제어와 모달리티 정렬에 한계가 있다.#Review#Synthetic Data Generation#Multi-View#RGB-T#Aerial Object Detection#Arma3#Benchmark#Oriented Bounding Box2026년 7월 22일댓글 수 로딩 중
[논문리뷰] FVAttn: Adaptive Sparse Attention with Runtime Load Balancing for Video GenerationVideo Diffusion Transformers(Video DiTs)는 고해상도 및 장기 비디오 생성 시 발생하는 막대한 Attention 연산 비용이 추론의 주된 병목 현상으로 작용합니다.#Review#Video Diffusion Transformers#Adaptive Sparse Attention#Runtime Load Balancing#Ulysses#Sequence Parallelism#P2P Communication#Slack-Aware Sparse Augmentation2026년 7월 22일댓글 수 로딩 중
[논문리뷰] DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations본 논문은 현대의 autonomous agent들이 복잡한 디지털 문서(spreadsheet, presentation, PDF 등)를 다룰 때 요구되는 높은 수준의 구조적 일관성과 엔드투엔드(end-to-end) 작업 수행 능력을 체계적으로 평가하는 프레임워크가 부족하다는 점을 해결하고자 합니다.#Review#Autonomous Agents#Document Manipulation#Benchmarking#State Tracking#Deterministic Verification2026년 7월 22일댓글 수 로딩 중
[논문리뷰] Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking본 논문은 RAG(Retrieval-Augmented Generation) 시스템에서 기존의 relevance 중심 평가 방식이 document set의 구조적 품질을 반영하지 못하는 한계를 해결하고자 한다.#Review#Retrieval-Augmented Generation#Document Set Selection#Evaluation Framework#LLM-as-a-Judge#Rubric-Oriented#Information Retrieval2026년 7월 22일댓글 수 로딩 중
[논문리뷰] Beyond Euclidean Clipping: Overcoming Exploration Collapse in LLM RL via Riemannian Isometric Policy Optimization본 논문은 LLM의 추론 성능 향상을 위한 RL 학습에서 발생하는 Exploration Collapse 문제를 해결하는 것을 목표로 한다.#Review#Reinforcement Learning#Large Language Models#Riemannian Manifold#Policy Optimization#Exploration Collapse#Geometric Isometry#PPO2026년 7월 22일댓글 수 로딩 중
[논문리뷰] An Exam for Active Observers본 논문은 현대의 MLLM들이 능동적인 시각적 관찰(Active Observation) 능력을 갖추고 있는지에 대해 의문을 제기합니다. 현재의 비전-언어 벤치마크들은 대부분 정적인 이미지 설명이나 단순한 시각적 질의응답에 치중되어 있어, 복잡한 인지 과정에서 필요한 반복적인 시각적 재탐색 능력을 측정하지 못합니다 .#Review#Active Vision#MLLM#Benchmark#Perception-Reasoning Loop#Iterative Perception#Active Observation2026년 7월 22일댓글 수 로딩 중