[논문리뷰] Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails본 논문은 Harness Evolution을 통해 성능을 높인 작은 모델들이 전문가 모델의 궤적을 모방(Imitation)할 때 발생하는 성능 저하 문제를 해결하고자 합니다.#Review#Agentic Tasks#Harness Evolution#On-Policy Correction#Model–Harness Fit#Imitation Learning#LoRA-SFT#Co-Evolution2026년 9월 9일댓글 수 로딩 중
[논문리뷰] Φ-Bench: Can Large Language Models Engineer the Infrastructure That Powers Them?본 논문은 LLM이 스스로를 구동하는 인프라를 엔지니어링하고 최적화할 수 있는지 평가하는 것을 핵심 목표로 한다. 기존 벤치마크들은 주로 고립된 커널이나 사전 정의된 연산자 구현에 초점을 맞추고 있어, 실제 환경에서 필요한 복잡한 시스템 탐색, 디버깅, 그리고 반복적인 최적화 과정을 평가하는 데 한계가 있다 .#Review#LLM Infrastructure#Benchmark#End-to-End Optimization#Kernel Function Completion#Long-Horizon Implementation#Software Engineering2026년 9월 9일댓글 수 로딩 중
[논문리뷰] AgenticGen: Reward-Guided Agentic Video Generation for Advertising본 연구는 광고 비디오 생성이 단순히 비디오 합성 task를 넘어, 온라인 비즈니스 metric에 의해 성공이 결정되는 제품-조건부 추론 문제임을 강조합니다.#Review#Agentic Video Generation#Reward-Guided Learning#Advertising AI#Reinforcement Learning#DPO#GRPO#Online Business Metrics2026년 9월 9일댓글 수 로딩 중
[논문리뷰] AgentGrad: Intervention-guided Prompt Optimization for Multi Agent Systems본 논문은 MAS의 프롬프트 최적화 과정에서 발생하는 기존 Textual Gradient 방법론의 비효율성과 일반화 문제를 해결하고자 한다.#Review#Multi-Agent Systems#Prompt Optimization#Textual Gradient#Sequential Intervention#Failure Attribution#LLM2026년 9월 9일댓글 수 로딩 중
[논문리뷰] A Three-Layer Caching Architecture for Low-Latency LLM Web Search on Commodity CPU Hardware본 논문은 상업용 AI 검색 서비스의 높은 API pricing 문제를 해결하고, 비용 효율적인 오픈 소스 검색 엔진인 OreoLook을 구축하기 위해 제안되었다.#Review#LLM caching architecture#AI-powered web search#semantic query deduplication#conversational session management#Redis multi-tier cache#Huffman compression#commodity CPU infrastructure2026년 9월 9일댓글 수 로딩 중
[논문리뷰] What LLM Trading Agents Actually Do in Production: A Six-Month, Population-Scale Record from Two Fleets본 연구는 대규모 실전 시장에서 운용되는 자율형 LLM trading agents가 실제로 어떠한 행동 양상을 보이며, 수익성에 어떠한 영향을 미치는지에 대한 실증적 기록을 제공합니다.#Review#LLM Trading Agents#Autonomous Trading#Market Microstructure#Systemic Risk#Agentic Workflow#Deployment Measurement2026년 9월 8일댓글 수 로딩 중
[논문리뷰] What Did I Just Say? Self-Listening for Full-Duplex Speech Models본 논문은 Full-Duplex 모델이 인터럽트 상황에서 자신이 실제로 발화한 내용을 인지하지 못하는 'Anchoring Gap' 문제를 해결하고자 한다.#Review#Full-Duplex Speech Models#Self-Listening#AnchorSpeech#Anchoring#Speech Synthesis#Interruption Recovery#Latency2026년 9월 8일댓글 수 로딩 중
[논문리뷰] VidaForge: Open Research Infrastructure for Video Pretraining Data Recipes본 논문은 현대의 Video Foundation Models이 대규모 데이터를 필요로 함에도 불구하고, 이러한 데이터를 생성하는 End-to-End 데이터 파이프라인이 폐쇄적이고 불투명하다는 점을 해결하고자 합니다.#Review#Video Foundation Models#Data Engineering#Pretraining Data Recipes#Attribution-ready Infrastructure#Video Generation#Representation Learning#Data Curation2026년 9월 8일댓글 수 로딩 중
[논문리뷰] TransNormal-2: Geometry-Grounded Rectified Flow with Edge-Aware Decoding for Precise Normal Estimation본 논문은 diffusion-based monocular geometry estimation에서 간과되었던 VAE reconstruction degradation이라는 근본적인 문제점을 제기한다.#Review#Surface Normal Estimation#Monocular Geometry Estimation#Latent Diffusion Models#Transparent Object Perception#VAE Reconstruction Degradation#Rectified Flow#Geometric Refinement Module2026년 9월 8일댓글 수 로딩 중
[논문리뷰] TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model본 논문은 휴머노이드 로봇이 복잡한 실내 환경에서 자연어 지침에 따라 Whole-Body Navigation을 수행하는 문제를 해결하고자 한다.#Review2026년 9월 8일댓글 수 로딩 중
[논문리뷰] SynthGait-19K: A Physically Grounded Synthetic Video Dataset for Gait Parameter Estimation본 논문은 임상적으로 의미 있는 보행 파라미터를 모노큘러 비디오에서 정확히 추정하고자 하나, 기존 연구들의 데이터셋은 규모가 작고 뷰포인트가 제한적이며 시각적 다양성이 부족한 문제를 해결하고자 합니다.#Review#Gait Parameter Estimation#Synthetic Dataset#Video Diffusion#Human Mesh Recovery#GaitXFormer#Computer Vision#Healthcare2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Steering Geometry: Validating Human Value Geometry in LLM Steering Space현재 대규모 언어 모델(LLM)의 행동 제어를 위한 Activation Steering은 효과적인 방법으로 부상했지만, Steering 벡터가 일관된 의미론적 구조(Semantic Structure)를 인코딩하는지, 아니면 단순히 행동별 단축키(Behavior-specific Shortcuts)를 이용하는지에 대한 명확한 이해가 부족합니다.#Review#LLM Steering#Activation Steering#Human Values#Value Geometry#Schwartz Theory#Moral Foundations Theory#Inference-time Control2026년 9월 8일댓글 수 로딩 중
[논문리뷰] SceneMosaic: Efficient and Diverse Simulation-Ready Scene Generation via Hybrid Agentic Layout Evolution본 논문은 기존 3D 씬 생성 방식의 고질적인 효율성-충실도 트레이드오프와 낮은 다양성 문제를 해결하고자 합니다.#Review#3D Scene Generation#Agentic Layout Evolution#Image-to-3D#Simulation-Ready#Local Unit Decomposition#Hybrid Framework2026년 9월 8일댓글 수 로딩 중
[논문리뷰] SQS: Bayesian DNN Compression through Sparse Quantized Sub-distributions본 연구는 대규모 신경망의 추론 비용을 줄이기 위한 기존 pruning과 quantization 기법들이 서로 독립적으로 수행될 때 발생하는 성능 저하 문제를 해결하고자 합니다.#Review#DNN Compression#Bayesian Variational Learning#Weight Pruning#Low-bit Quantization#Spike-and-Slab Prior#Gaussian Mixture Models#Outlier-aware Windowing2026년 9월 8일댓글 수 로딩 중
[논문리뷰] RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks?본 연구는 VLA models이 단순한 장면과 단기 Task를 넘어 복잡한 embodied reasoning 능력을 갖추도록 돕기 위한 진단 벤치마크의 필요성을 제기합니다.#Review#VLA models#Robotic Manipulation#Spatial Reasoning#Procedural Planning#Embodied AI#Benchmark2026년 9월 8일댓글 수 로딩 중
[논문리뷰] RelightFormer: Feed-forward Generative Transformer for Multiview Object Relighting본 연구는 기존의 이미지 재조명 방식이 겪는 역렌더링의 불투명성과 단일 이미지 기반 모델의 다중 뷰 정보 부재 문제를 해결하고자 한다.#Review#Image Relighting#Generative Model#Transformer#Multiview#Foundation Model#Diffusion#Inverse Rendering2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Recognition-Refusal Misalignment in LLMs: Why Models Answer Structurally Unanswerable Questions본 논문은 LLM이 structurally unanswerable questions, 예를 들어 cot(−540∘) 계산이나 (1).startswith('1') 평가와 같이 유효한 답이 없는 질문에 대해 abstention 대신 answer-like outputs을 제공하는 문제를 다룹니다.#Review#Recognition–Refusal Misalignment#LLMs#Unanswerable Questions#Internal Representations#Safety Refusal#Activation Steering#Pretraining2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Reason Through the Latent! Making Latent Visual Reasoning Necessary본 논문은 기존 Latent Visual Reasoning 방법론들이 latent state에 task-relevant visual information을 포함하더라도, 모델이 실제로 해당 state에 의존하여 예측을 수행하는지에 대한 근본적인 모호성을 해결하고자 한다.#Review#Latent Visual Reasoning#Causal Intervention#Recurrent Neural Networks#Multimodal LLMs#Visual Question Answering#Vision-Language Models2026년 9월 8일댓글 수 로딩 중
[논문리뷰] ReactVAU: A Slow-Fast Decoupled Framework for Streaming Video Anomaly Understanding본 논문은 기존의 고성능 VAU 모델들이 전체 영상 정보를 미리 파악해야 하는 Offline Inference 방식에 의존함에 따라 실시간 스트리밍 환경에서 적용 불가능하다는 문제점을 해결하고자 합니다.#Review#Video Anomaly Understanding#Streaming Video Understanding#Multimodal LLM#LLM Memory#Slow-Fast Decoupled Framework2026년 9월 8일댓글 수 로딩 중
[논문리뷰] Procedural Graphs: Self-Evolving Execution Structures for LLM Agents본 논문은 기존 LLM 에이전트가 긴 호흡의 태스크 수행 시 겪는 절차적 일관성 상실 문제를 해결하고자 합니다. 대부분의 에이전트는 누적된 기록에 의존한 무제약 생성(unconstrained generation) 방식을 채택하고 있어, 목표를 망각하거나 도구를 부적절한 순서로 호출하는 한계가 있습니다.#Review#LLM Agents#Procedural Graphs#Self-Evolution#Tool Use#Planning#Execution Structures#Situational Guidance2026년 9월 8일댓글 수 로딩 중