[논문리뷰] Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-Training본 연구는 RL Post-Training을 거친 모델들이 기존의 고정된 Draft Model과 호환되지 않아 Speculative Decoding의 성능이 급격히 하락하는 문제를 해결합니다.#Review#Speculative Decoding#RL Post-Training#Draft Model#Co-Training#Long-Context#Inference Latency#Large-Scale2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Omni Interaction Agent Technical Report본 논문은 기존의 Turn-based Human-AI Interaction 패러다임이 Human-Human Communication의 Fluid하고 Collaborative한 특성을 반영하지 못하는 핵심 문제를 해결하고자 합니다.#Review#Omni Interaction Agent#Full-Duplex Interaction#Multimodal Perception#Agentic Capabilities#Cerebellum-Brain Framework#Streaming Thinker-Talker Architecture#Realtime Interaction2026년 9월 8일댓글 수 로딩 중
[논문리뷰] NeoHorse-1: Towards Recursive Self-Improvement via Agentic Post-Training with Routing Harness본 논문은 AI 시스템이 자신의 역량을 관찰하고 이를 다음 학습에 활용하는 구체적인 메커니즘을 통해 Recursive Self-Improvement (RSI)를 실현하는 데 중점을 둡니다.#Review#Recursive Self-Improvement#Agentic Post-Training#Agentic Routing#Curriculum Learning#On-Policy Distillation2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Multi-Grid Post-Training for Long-Form Multi-Shot Video Generation죄송합니다만, 현재 요청하신 논문(2609.06373)의 URL에 직접적인 액세스가 제한되어 상세 내용을 분석할 수 없습니다. 2609로 시작하는 번호는 미래의 날짜(2026년 9월)를 나타내는 것으로 보이며, 현재 시점에서는 공개된 논문 아카이브에 정확히 매칭되지 않는 자료일 가능성이 높습니다.#Review2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Miles v0.1: Production-Level Post-Training본 연구는 고성능 LLM을 구축하기 위한 Post-Training 과정의 파편화와 높은 진입 장벽 문제를 해결하는 것을 목표로 합니다. 많은 오픈 소스 모델이 등장하고 있으나, 이를 실제 Production 환경에 배포하기 위한 체계적인 Post-Training 파이프라인은 여전히 부족한 실정입니다.#Review#Post-Training#LLM Alignment#SFT#RLHF#Production-Level#Model Optimization2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Measuring Language Transfer in Robot Policies: Adding Greek to a Cosmos3 Vision-Language-Action Policy본 연구는 대규모 VLA 모델이 학습 데이터에 존재하지 않는 언어 환경에서도 로봇 제어 명령을 효과적으로 처리할 수 있는지 검증하고자 합니다. 대다수의 VLA 모델은 영어 데이터 위주로 학습되어 있어, 비영어권 환경에서의 일반화(Generalization) 성능에 한계가 존재합니다.#Review#Vision-Language-Action#Robot Policy#Language Transfer#Cosmos3#Multilingual#Cross-lingual Transfer2026년 9월 8일댓글 수 로딩 중
[논문리뷰] MasterControl Seventeen Every Time본 논문은 엔터프라이즈 환경에서 데이터 분석의 결과가 '단순한 숫자'에 그치지 않고 그 의미와 근거를 완벽히 보존해야 한다는 문제의식에서 출발한다.#Review#Governed Data Analysis#Deterministic Policy#Analytical Algebra#Runtime Tool Planning#Enterprise Analytics#Relational Logic2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Mask Forcing: Improving Autoregressive Video Diffusion Distillation via Dual-Noise Masking Rollout본 연구는 Autoregressive (AR) video diffusion models이 실시간 비디오 생성에서 큰 잠재력을 보이지만, 생성된 비디오가 과도한 채도(over-saturation) 및 과도한 스무딩(over-smoothing) 문제로 인해 시각적 품질(visual quality)과 사실성(realism)이 제한되는 문제점을 해결하고자 합니다.#Review#Autoregressive Video Diffusion#Distribution Matching Distillation (DMD)#Mode Collapse#Dual-Noise Masking Rollout#Video Generation#Self-rollout#Visual Quality#Real-time Inference2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation본 논문은 기존의 확산 모델 기반 depth 추정 방식이 가지는 미세 디테일 손실 및 경계 흐림 현상을 해결하고자 합니다.#Review#Monocular Depth Estimation#Diffusion Transformers#Sinkhorn Matching#Representation Alignment#iREPA#Parameter-Efficient Fine-Tuning#Generative Computer Vision2026년 9월 8일댓글 수 로딩 중
[논문리뷰] MOLE: Detecting Insider Threats in AI Agents본 논문은 frontier lab의 AI agent들이 모델 가중치 탈취, 데이터 오염 등 심각한 보안 위협을 초래할 수 있음에도 불구하고, 이를 실시간으로 탐지할 수 있는 체계적인 벤치마크가 부재하다는 문제에서 출발한다.#Review#AI Agents#Insider Threat Detection#Benchmark#Safety Monitoring#Service-Oriented Architecture#Human-AI Interaction#Service Trace2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Learning 3D Editing without Paired Supervision via Generative Prior Distillation본 논문은 대규모 Paired 3D 데이터의 극심한 부족 문제를 해결하고자, 지도 학습 기반 3D 편집 모델의 한계를 극복하는 새로운 방식을 제안합니다.#Review#3D Editing#Generative Priors#Unpaired Learning#Distribution Matching Distillation#Vision-Language Model#3D Gaussian Splatting2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Kalman Delta Networks: Uncertainty-aware Associative Memory본 연구는 기존 Associative Memory 모델들이 데이터 내재적인 불확실성을 적절히 처리하지 못하고 정적인 기억 저장에 치중한다는 점을 해결하기 위해 시작되었습니다.#Review#Kalman Delta Networks#Associative Memory#Uncertainty-aware#Neural Dynamics#Memory Retrieval#Kalman Filtering2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Harnessing CLIP and DINO: An Uncertainty-Aware Cascaded Fusion Network for Generalizable Deepfake Image Detection본 논문은 기존 Deepfake Detector들이 단일 Vision Foundation Model에 의존함에 따라 발생하는 특정 분포에 대한 과적합(Overfitting) 문제를 해결하고자 합니다.#Review#Deepfake Detection#CLIP#DINO#Uncertainty-Aware#Feature Fusion#Generalization#Foundation Models2026년 9월 8일댓글 수 로딩 중
[논문리뷰] GE-Act 2.0: Pretraining and Scaling a World-Action Model for Robotic Manipulation본 논문은 기존 World-Action Models(WAM)가 주로 기학습된 비디오 생성기에 의존하며, 모델 전체의 사전 학습 및 확장성(scaling)에 대한 연구가 부족하다는 점을 해결하고자 합니다.#Review#World-Action Model#Robotic Manipulation#Control-Oriented Autoencoder#Single-Step Visual Planner#Inverse Dynamics Model#Zero-Shot OOD Generalization#KASO2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Environments as Scaffold: Enriching Feedback to Bootstrap Self-Evolving Agents in Long-Horizon Tasks제공해주신 URL(https://arxiv.org/html/2609.08404)에 대한 접근이 현재 제한된 상태입니다. 논문의 핵심 내용을 직접 분석하기 위해 해당 페이지의 내용을 확인할 수 없습니다.#Review2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Encoded Early, Used Late: Where Transformers Begin to Act on an Inferred Partner's Expertise본 논문은 Transformer가 추론해야 하는 속성(Inferred Attribute)인 '파트너의 전문성'이 모델 내 어디에서 표현되고, 어디에서 행동으로 변환되는지를 규명하고자 합니다 .#Review#Transformer#Expertise Inference#Interpretability#Activation Patching#Residual Stream#Causal Analysis#Linear Probing2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation기존의 Distillation 방식은 약한 교사 모델의 정책을 직접적인 최적화 목표(Optimization Target)로 설정함으로써, 학생 모델이 교사의 능력적 한계에 갇히게 되는 문제를 야기한다. 특히 대규모 모델의 post-training을 매번 처음부터 수행하는 것은 컴퓨팅 자원 측면에서 매우 비효율적이다.#Review2026년 9월 8일댓글 수 로딩 중
[논문리뷰] DriveZero: End-to-End Driving Beyond Human Demonstrations대부분의 End-to-End 자율주행 시스템은 인간의 주행 로그를 모방하여 학습하며, 이는 학습된 행동이 기록된 궤적의 품질과 커버리지에 의해 제한되는 문제점을 안고 있다.#Review#End-to-End Driving#Reinforcement Learning#Vision Foundation Models#Distillation#Closed-Loop RL#Trajectory Planning#Goal Augmentation2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Counter-Swarm Doctrine: Containing Coordinated Agent Intrusions본 논문은 여러 독립적인 agent들이 공유 인프라를 활용하여 인가되지 않은 협업을 수행하고, 이를 통해 보안 경계(Isolation)를 우회하는 위협을 해결하고자 합니다.#Review#Multi-agent Security#Stigmergy#Coordination Episode#Agent Intrusion#Shared Infrastructure#Defensive Doctrine#Prospective Episode Discovery2026년 9월 8일댓글 수 로딩 중
[논문리뷰] CosmoH2G: A Hand-to-Gripper Transfer Dataset and Baseline Method for Object Manipulation with Complex Spatial Movements본 연구는 인간 시연(Human Demonstration)으로부터 로봇 학습(Robot Learning)이 비용 효율적이지만, 기존 방법론들이 복잡한 공간 움직임(Spatial Movement)을 다루는 데 실패한다는 핵심 문제를 해결하고자 합니다.#Review#Robot Manipulation#Human-to-Robot Transfer#Complex Spatial Movements#Hand-to-Gripper Transfer#Denoising Transformer#Paired Dataset#6-DoF Pose2026년 9월 8일댓글 수 로딩 중