[논문리뷰] A Frozen Pixel-Space Diffusion Model Can Guide Itself with Its Own SamplesPixel-space diffusion models은 VAE와 같은 압축 단계를 거치지 않는 단순한 구조를 가지지만, 단일 모델이 고해상도의 전역 구조와 국부적인 질감을 동시에 최적화해야 하는 어려움이 있습니다.#Review#Pixel-Space Diffusion#Self-Guidance#Synthetic Data#Flow Matching#Adapter Training#Frequency Analysis2026년 8월 3일댓글 수 로딩 중
[논문리뷰] 3DZip: Spatial-Aware Feature Diversity-Guided Token Compression for 3D Question Answering본 논문은 projection-based 3D VLM에서 발생하는 극심한 token 중복성 문제를 해결하고자 합니다.#Review#3D Vision-Language Models#Token Compression#Feature Diversity#Determinantal Point Process#3D Question Answering#Spatial Reasoning2026년 8월 3일댓글 수 로딩 중
[논문리뷰] Would You Walk to the Car Wash? Revealing the Salience Bias of Large Language Models in Commonsense Reasoning본 논문은 LLM이 복잡한 수학적 문제나 코딩 작업에서 명시적 조건을 활용하는 데 최적화되어 있으나, 이로 인해 오히려 일반적인 상식 추론 상황에서 'Salience Bias'라는 치명적인 약점을 노출한다는 점을 지적합니다 .#Review#Salience Bias#Commonsense Reasoning#Large Language Models#SaliTrap Benchmark#Sycophantic Compliance#Knowledge Suppression2026년 8월 2일댓글 수 로딩 중
[논문리뷰] Toward Robust and 3D-Aware RGB-NIR Imaging in the Dark본 논문은 극한의 저조도 환경에서 Clean RGB 데이터 없이도 노이즈가 심한 RGB와 NIR 데이터를 효과적으로 융합하여 고품질 이미지를 복원하는 3D-aware 프레임워크를 제안합니다.#Review#Low-light Imaging#RGB-NIR Fusion#Neural Radiance Fields#3D-aware Modeling#Unsupervised Denoising#Positional Encoding2026년 8월 2일댓글 수 로딩 중
[논문리뷰] Scaling Properties of Text Conditioning in Visual Generation본 논문은 텍스트 기반 이미지 생성(Text-to-Image Generation)에서 자연어의 토큰 수와 실제 모델이 학습하는 정보량 사이에 존재하는 비대칭성 문제를 해결하고자 합니다.#Review#Visual Generation#Text Conditioning#Scaling Laws#Structured Prompts#GPG#Effective Detailness#Promptability#Diffusability2026년 8월 2일댓글 수 로딩 중
[논문리뷰] Safeguards Based on Copyable Context Cannot Provide Reliable Safety for LLMs본 논문은 LLM의 safeguard가 응답의 실제 활용 방식을 알기 전에 필터링을 수행함으로써 발생하는 근본적인 한계를 지적한다. 기존의 안전장치들은 사용자의 의도나 대화 이력을 기반으로 결정을 내리지만, 공격자는 이러한 증거들을 정교하게 모방하여 승인된 사용자로 위장할 수 있다 .#Review#LLM#Safeguards#Dual-use#Capability-Safety Trilemma#Trusted Credentials#Copyable Evidence2026년 8월 2일댓글 수 로딩 중
[논문리뷰] SULAND v2: A Refined RGB Dataset and Deep Learning Object Detection Benchmark for UAV/UGV-Based SUrface LANDmine Detection Under Domain Shift본 연구는 UAV/UGV 환경에서 지표면 지뢰를 탐지하는 Deep Learning 기반 객체 탐지 모델들의 Domain Shift 상황에서의 일반화 성능을 명확히 규명하고자 한다.#Review#Surface Landmine Detection#UAV/UGV#Dataset Refinement#Domain Shift#Object Detection#Benchmark2026년 8월 2일댓글 수 로딩 중
[논문리뷰] SGTP: Sampling-based Game-Theoretic Planning for Real-Time Multi-Vehicle Autonomous Racing본 논문은 기존의 자율 주행 레이싱 시스템이 실시간성 확보와 경쟁적인 다차량 상호작용 구현 사이에서 겪는 트레이드오프 문제를 해결한다.#Review#Autonomous Racing#Game-Theoretic Planning#Iterative Best Response#GPU-accelerated Sampling#Trajectory Planning#Multi-Vehicle Interaction2026년 8월 2일댓글 수 로딩 중
[논문리뷰] SAF-OPD: Stable Advantage Fusion for On-Policy Distillation본 논문은 RLVR과 OPD를 결합할 때 발생하는 고정 계수 통합 방식의 한계를 해결하고자 합니다. 기존 방식은 GRPO의 안정적인 보상과 OPD의 조밀한 피드백을 단순히 더하지만, 실제로는 두 보상의 크기와 시간적 가중치가 서로 달라 학습 과정에서 Entropy Collapse와 같은 심각한 불안정성을 유발합니다 .#Review#Reinforcement Learning#On-Policy Distillation#Advantage Fusion#Large Language Models#GRPO#Training Dynamics#Entropy Collapse2026년 8월 2일댓글 수 로딩 중
[논문리뷰] RL^2-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models본 논문은 사전 학습된 VLA 모델이 Out-of-Domain(OOD) 환경이나 도전적인 작업에서 성능이 저하되는 문제를 해결하고자 한다.#Review#Vision-Language-Action Models#Reinforcement Learning#Test-Time Scaling#Compositional Steering#Adaptive Inference#Flow-Matching#Robotics2026년 8월 2일댓글 수 로딩 중
[논문리뷰] QQWorld: Quantile-Quantile Matching for World Model Regularization본 논문은 기존 LeWM에서 사용하는 EP 정규화 기법이 잠재 공간의 heavy-tailed 분포를 효과적으로 제어하지 못한다는 한계에서 출발한다.#Review#World Model#Latent Regularization#Quantile-Quantile Matching#Epps-Pulley Test#Representation Learning#Heavy-tailed Distributions2026년 8월 2일댓글 수 로딩 중
[논문리뷰] One Future, Every Robot: Label-Efficient Collective-State Prediction with Decentralized JEPA본 논문은 로봇 스웜에서 각 로봇이 독립적인 로컬 관측을 바탕으로, 어떻게 동일한 Shared Future Collective State를 예측할 수 있는지에 대한 문제를 해결하고자 합니다.#Review#Robot Swarms#JEPA#Collective-State Prediction#Decentralized Inference#Label Efficiency#Multi-Agent World Models#Counterfactual Value Estimation2026년 8월 2일댓글 수 로딩 중
[논문리뷰] ODEWorld: A Continuous Predictive Architecture via Physical-Time Flow본 논문은 기존 월드 모델들이 이산 시간(discrete-time) 패러다임에 국한되어 있어 물리적 세계의 연속적인 성질을 반영하지 못하고 효율성이 저하되는 문제를 해결하고자 한다.#Review#World Models#Neural ODE#Physical-Time Flow#Representation Learning#Robotic Control#Video Generation2026년 8월 2일댓글 수 로딩 중
[논문리뷰] Not All Tokens Deserve Equal Credit: Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning본 논문은 Long-CoT 추론 학습 시 기존 GRPO와 같은 방식이 응답 내 모든 토큰에 동일한 중요도를 부여하여 발생하는 최적화 비효율 문제를 해결하고자 합니다.#Review#Long-CoT Reasoning#RLVR#GRPO#On-policy Self-distillation#Counterfactual Sensitivity#Credit Reallocation2026년 8월 2일댓글 수 로딩 중
[논문리뷰] N_0-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens제시해주신 URL(https://arxiv.org/html/2607.23782)에 대해 접근을 시도하였으나, 기술적 제약으로 인해 해당 페이지의 콘텐츠를 직접 열람할 수 없었습니다.#Review2026년 8월 2일댓글 수 로딩 중
[논문리뷰] N_0-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation본 논문은 정밀한 접촉이 필요한 manipulation 작업에서 기존의 순수 visuomotor 회귀 방식이 갖는 한계인 '촉각 정보의 부재'와 '미래 예측 능력의 결여'를 해결하고자 합니다.#Review#Tactile-Native#World-Action Model#Mixture-of-Transformers#Contact-Rich Manipulation#Flow-Matching#NeoForce2026년 8월 2일댓글 수 로딩 중
[논문리뷰] Meshy T2: Fast Native Mesh Generation with Flow Matching죄송합니다. 현재 요청하신 논문(https://arxiv.org/html/2607.28675)에 직접 접근하여 상세 내용을 추출하는 데 기술적인 제한이 발생하였습니다.#Review2026년 8월 2일댓글 수 로딩 중
[논문리뷰] Mental World Modeling본 연구는 기존의 World Models가 물리적 환경(객체, 위치, 운동 등)의 진화만을 추적할 뿐, 인간 행동의 근본 원인인 정신적·사회적 변수를 간과하고 있다는 문제 의식에서 출발합니다.#Review#Mental World Modeling#World Model#Theory of Mind#POMDP#Embodied AI#Social Intelligence#LLM2026년 8월 2일댓글 수 로딩 중
[논문리뷰] In the Driver's Seat: A Multi-Company Study on the Reality of Autonomous Driving System Testing본 논문은 급격하게 발전하는 ADS 기술에 비해 정립된 테스트 표준이나 검증 프로세스가 부족하다는 업계의 현실을 진단한다. 기존의 ADS 테스트는 시나리오 선정, 성과 평가 지표(Metric), 그리고 합격 기준(Acceptance Criteria)에 대한 명확한 정의가 부재하여 체계적인 안전성 보증이 어렵다 .#Review#Autonomous Driving#Testing#Industry Practices#Challenges#Future Trends#Interviews#Testing Framework2026년 8월 2일댓글 수 로딩 중
[논문리뷰] From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement본 논문은 기존 RLVR의 적용 범위가 수학이나 코딩 등 결정론적 환경에만 국한되어 있다는 한계를 해결하고자 합니다.#Review#RLSVR#SpyRL#Self-Play#Task Transformation#Reinforcement Learning#Open-Ended LLM Self-Improvement#Verifiable Rewards2026년 8월 2일댓글 수 로딩 중