[논문리뷰] DF3DV-1K: A Large-Scale Dataset and Benchmark for Distractor-Free Novel View Synthesis본 연구는 기존 Distractor-Free Radiance Field 연구들이 대규모의 체계적인 데이터셋과 벤치마크의 부재로 인해 방법론의 강점과 한계를 파악하기 어렵다는 문제를 해결합니다.#Review#Distractor-Free#Novel View Synthesis#Radiance Fields#3D Dataset#Benchmark#Diffusion-based Enhancement#DI2FIX2026년 6월 18일댓글 수 로딩 중
[논문리뷰] Current World Models Lack a Persistent State Core본 논문은 현대의 World Models가 정교한 프레임을 생성할 수는 있으나, 관찰자가 보고 있지 않을 때에도 독립적으로 진화해야 하는 '지속적인 세계 상태(Persistent State Core)'를 결여하고 있다는 점을 지적합니다.#Review#World Models#Persistent State#Viewpoint Intervention#WRBench#Video Generation#Diagnostic Benchmark#World-State Consistency2026년 6월 18일댓글 수 로딩 중
[논문리뷰] Beyond Static Leaderboards: Predictive Validity for the Evaluation of LLM Agents본 논문은 현대의 LLM 에이전트가 단일 점수 기반의 정적 리더보드로는 충분히 평가될 수 없으며, 이로 인해 Rank Instability가 발생한다는 점을 지적합니다.#Review#LLM Agents#Predictive Validity#Benchmark#Evaluation#Out-of-Distribution#MCP#Leaderboard2026년 6월 18일댓글 수 로딩 중
[논문리뷰] Adaptive Volumetric Mechanical Property Fields Invariant to Resolution본 논문은 기존 3D 에셋이 물리 시뮬레이션에 필수적인 재질 정보(Young's modulus, Poisson's ratio, density)를 결여하고 있어, 사실적인 물리 시뮬레이션 구현에 병목 현상을 겪고 있다는 문제를 해결합니다 .#Review#Mechanical Properties#Sparse Adaptive Voxels#Physics Simulation#Autoregressive Generation#3D Assets#Material Fields2026년 6월 18일댓글 수 로딩 중
[ray] Ray Core의 Lock Contention 해결: Publisher의 비동기 처리 도입Ray의 Object Pubsub 로직을 IO 스레드로 분리하여 스케줄링 루프의 Lock Contention을 획기적으로 개선한 사례를 분석합니다.#Ray#C++#Concurrency#Performance#Distributed Systems2026년 6월 17일댓글 수 로딩 중
[sglang] SGLang 성능 최적화: Speculative Decoding의 H2D 병목 해결 및 코드 중복 제거Speculative Decoding 경로에서 발생하는 동기식 H2D 복사를 비동기 방식으로 최적화하고, 중복된 로직을 통합하여 성능을 개선했습니다.#SGLang#LLM#Performance#PyTorch#SpeculativeDecoding2026년 6월 17일댓글 수 로딩 중
[sglang] [성능 최적화] SGLang `prepare_for_decode`에서 `latest_output_ids` H2D 복사 비동기화로 디코딩 처리량 30% 향상SGLang 디코딩 과정에서 `latest_output_ids`의 H2D 복사를 비동기화하여 성능을 크게 개선한 사례 분석.#SGLang#PyTorch#CUDA#성능 최적화#GPU#LLM#H2D#비동기 프로그래밍2026년 6월 17일댓글 수 로딩 중
[vllm] vLLM에서 Flashinfer 기반 Non-gated MoE bf16 지원 최적화 분석vLLM의 Flashinfer-TRTLLM 백엔드에 Non-gated MoE bf16 지원을 추가하여 성능을 약 15% 향상시킨 기술적 변경사항을 분석합니다.#vLLM#MoE#Flashinfer#DeepLearning#Optimization2026년 6월 17일댓글 수 로딩 중
[논문리뷰] iOSWorld: A Benchmark for Personally Intelligent Phone Agents본 논문은 기존 모바일 에이전트 벤치마크가 사용자의 지속적인 데이터와 상호 연관된 개인적 문맥을 결여하고 있다는 점을 지적하며, '개인 지능(Personal Intelligence)'을 갖춘 에이전트 평가의 필요성을 제기합니다.#Review#iOSWorld#Mobile Agents#Personal Intelligence#Human-Computer Interaction#LLM-as-a-Judge#Multi-app Reasoning#Simulator Benchmark2026년 6월 17일댓글 수 로딩 중
[논문리뷰] Trust the Right Teacher: Quality-Aware Self-Distillation for GUI Grounding본 논문은 OPSD 학습 과정에서 발생하는 교사 모델 신호의 품질 저하 문제를 해결하기 위해 Quality-Aware Self-Distillation을 제안한다.#Review#GUI Grounding#On-Policy Self-Distillation#Teacher-Signal Reliability#Vision-Language Models#Correctness-Aware Gating#Probability Scaling2026년 6월 17일댓글 수 로딩 중
[논문리뷰] Sumi: Open Uniform Diffusion Language Model from Scratch본 연구는 대규모 파라미터와 데이터 스케일로 scratch부터 사전 학습된 UDLM의 부재를 해결하고자 한다.#Review#Uniform Diffusion Language Model#UDLM#Diffusion Models#Pre-training#Scaling#Generation Dynamics#Sumi2026년 6월 17일댓글 수 로딩 중
[논문리뷰] SciOrch: Learning to Orchestrate Expert LLMs for Solving Frontier Multimodal Scientific Reasoning Tasks본 논문은 frontier multimodal scientific reasoning 분야에서 단일 상용 LLM 시스템이 전문가 수준의 성능을 달성하지 못하는 한계를 극복하고자 합니다.#Review#Multimodal Scientific Reasoning#LLM Orchestration#MCTS#Reinforcement Learning#Expert Model Delegation#Agentic Workflow2026년 6월 17일댓글 수 로딩 중
[논문리뷰] STARE: Surprisal-Guided Token-Level Advantage Reweighting for Policy Entropy Stability본 논문은 RLVR 기반의 LLM 학습 과정에서 빈번하게 발생하는 Policy Entropy Collapse 문제를 해결하고자 합니다. 기존의 GRPO는 학습이 지속됨에 따라 출력 다양성이 사라지고 모델이 조기에 수렴하는 현상을 겪으며, 이는 장기적인 포스트 트레이닝의 병목 현상으로 작용합니다 .#Review#Reinforcement Learning#Policy Entropy#GRPO#Advantage Reweighting#Surprisal#LLM Post-training#Credit Assignment2026년 6월 17일댓글 수 로딩 중
[논문리뷰] SAE Interventions are Unreliable: Post-Intervention Recovery of Suppressed Behavior본 논문은 SAE를 이용한 잠재 공간(latent-space) 방어 기법들이 행동을 완전히 통제하지 못할 수 있다는 한계점을 지적합니다.#Review#Sparse Autoencoders#Intervention#Post-Intervention Recovery#Constrained Optimization#Interpretability#Safety#Residual Stream2026년 6월 17일댓글 수 로딩 중
[논문리뷰] Reinforcing Dual-Path Reasoning in Spatial Vision Language Models본 논문은 기존의 Spatial VLM들이 가진 복합적인 공간 추론 능력의 한계를 극복하고자 합니다. 현재의 모델들은 단순한 기하학적 인식에는 강점을 보이나, 깊이 정보와 거리 비교, 장면 관계가 얽힌 복합적인 다단계 추론에는 여전히 취약합니다 .#Review#Spatial Vision-Language Models#Reinforcement Learning#Dual-Path Reasoning#Chain-of-Thought#3D Grounding#Geometric Reasoning2026년 6월 17일댓글 수 로딩 중
[논문리뷰] RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents본 논문은 Multi-turn Tool-Use 에이전트 학습 시 발생하는 데이터 부족 및 정보 밀도 감소 문제를 해결하고자 합니다.#Review#Multi-turn Tool-Use#Reinforcement Learning#Data Synthesis#Gradient Variance#Capability Boundary#Agentic RL#Replay Buffer2026년 6월 17일댓글 수 로딩 중
[논문리뷰] Physics-IQ Verified본 논문은 기존 Physics-IQ benchmark가 물리적 이해도를 측정하는 데 있어 포함하고 있는 측정 오류(Measurement Error)와 평가 프로토콜의 한계를 해결하고자 한다.#Review#Video Generative Models#Physical Reasoning#Benchmark#Evaluation#Ground Truth#Artifacts#Physics-IQ2026년 6월 17일댓글 수 로딩 중
[논문리뷰] PAIWorld: A 3D-Consistent World Foundation Model for Robotic Manipulation기존의 World Foundation Models는 대부분 단일 뷰(Single-view) 기반으로 동작하거나, 다중 뷰를 단순히 시퀀스 차원에서 연결(Concatenation)하는 방식을 취하여 로봇 조작에 필수적인 3D 일관성 문제를 해결하지 못한다.#Review#World Foundation Model#Robotic Manipulation#3D Consistency#Diffusion Transformer#Flow Matching#Multi-view Generation2026년 6월 17일댓글 수 로딩 중
[논문리뷰] Native Active Perception as Reasoning for Omni-Modal Understanding본 논문은 기존의 패시브한 Long Video Understanding 모델들이 가진 컴퓨팅 자원 및 성능의 한계를 해결하기 위해 제안되었습니다. 기존 연구들은 비디오 전체를 균일하게 처리하거나 전역적 사전 스캔에 의존함으로써, 비디오 길이에 따라 계산 비용이 선형적으로 증가하는 고질적인 병목 현상을 겪고 있습니다 .#Review#Omni-modal Understanding#Active Perception#POMDP#Agentic Reasoning#Test-time Scaling#TAURA#Reinforcement Learning2026년 6월 17일댓글 수 로딩 중
[논문리뷰] MyPCBench: A Benchmark for Personally Intelligent Computer-Use Agents본 논문은 기존의 Computer-Use 에이전트 벤치마크가 실사용 환경과 동떨어진 '개인성(Impersonality)' 결여 문제를 해결하고자 한다.#Review#Computer-Use Agents#Personalization#Benchmark#Linux Desktop#Agent Harness#Cross-App Consistency2026년 6월 17일댓글 수 로딩 중