[논문리뷰] Conditional Equivalence of DPO and RLHF: Implicit Assumption, Failure Modes, and Provable Alignment본 연구는 DPO와 RLHF 간의 이론적 동치성이 모든 경우에 성립하는 것이 아니라, 특정 가정에 의존하는 조건부 동치성임을 밝힙니다.#Review#DPO#RLHF#Constrained Preference Optimization#Bradley-Terry Model#Alignment#Soft Margin Ranking#Absolute Advantage2026년 5월 20일댓글 수 로딩 중
[논문리뷰] A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook본 논문은 LALMs 분야의 급격한 발전에도 불구하고, 모델의 성능 평가 기준과 범용적 활용에 대한 통합적인 체계가 부족하다는 점을 해결하고자 한다.#Review#Large Audio Language Models#Audio-Language Pretraining#Multimodal Foundation Models#Audio Reasoning#Model Alignment#Generalization#Trustworthiness2026년 5월 20일댓글 수 로딩 중
[ray] [Ray Data] Wide Schema에서 10배 성능 향상을 이끌어낸 한 줄의 설정: Parquet pre_buffer의 마법Ray Data V2에서 wide schema Parquet 파일을 읽을 때 발생하는 I/O 병목 현상을 pre_buffer 설정을 통해 해결하고 성능을 10배 개선한 사례를 분석합니다.#Ray#PyArrow#Parquet#Performance Optimization#Data Engineering2026년 5월 19일댓글 수 로딩 중
[vllm] vLLM 성능 최적화: GPU-CPU 간 불필요한 동기화 제거하기vLLM에서 GPU와 CPU 간의 불필요한 동기화를 제거하여 추론 성능을 극대화하는 최적화 기법을 분석합니다.#vLLM#LLM#Performance#GPU#Optimization2026년 5월 19일댓글 수 로딩 중
[triton] AMD GPU에서 불필요한 워프 로드를 제거하여 성능을 최적화한 Triton PR 분석AMD GPU 아키텍처에서 불필요한 데이터 로드를 방지하여 VGPR 사용량을 최대 35% 줄이는 최적화 기법을 분석합니다.#Triton#AMD GPU#Optimization#LLVM#Compiler2026년 5월 19일댓글 수 로딩 중
[논문리뷰] optimize_anything: A Universal API for Optimizing any Text Parameter본 논문은 최적화 문제를 텍스트 아키텍처 개선으로 정의하고, 이를 통해 다양한 도메인에서 범용적으로 작동하는 통합 최적화 시스템을 제안한다.#Review#LLM optimization#text artifact optimization#evolutionary search#agentic systems#Pareto optimization#declarative API2026년 5월 19일댓글 수 로딩 중
[논문리뷰] Where Does Authorship Signal Emerge in Encoder-Based Language Models?죄송합니다. 제공해주신 논문 URL https://arxiv.org/html/2605.19908에 접속하여 내용을 가져오는 데 실패했습니다. 따라서 논문을 분석하고 요약하는 작업을 수행할 수 없습니다.#Review2026년 5월 19일댓글 수 로딩 중
[논문리뷰] When Vision Speaks for Sound본 논문은 최신 Video-LLMs가 오디오 이해 능력을 갖춘 것처럼 보이지만, 실제로는 오디오를 검증하지 않고 시각적 단서에서 사운드를 추론하거나 할루시네이션(Hallucination)을 일으키는 Clever Hans effect에 빠져 있음을 지적합니다 .#Review#Video-LLMs#Audio-Visual Grounding#Clever Hans Effect#Intervention-Driven Diagnostics#Direct Preference Optimization (DPO)#Multimodal Alignment2026년 5월 19일댓글 수 로딩 중
[논문리뷰] Video Models Can Reason with Verifiable Rewards본 논문은 기존의 비디오 생성 모델이 시각적 사실성(Perceptual Realism)은 뛰어나지만, 특정 논리적 제약을 만족해야 하는 추론 문제 해결에는 한계가 있다는 점을 지적합니다. 기존의 지도 학습(SFT) 방식은 생성된 영상의 외형적 패턴을 모방할 뿐, 영상 내부의 물리적·논리적 올바름을 보장하지 못합니다 .#Review#Video Generation#Reinforcement Learning#Verifiable Rewards#Video Reasoning#Diffusion Models#Flow-Matching#RLVR2026년 5월 19일댓글 수 로딩 중
[논문리뷰] TideGS: Scalable Training of Over One Billion 3D Gaussian Splatting Primitives via Out-of-Core Optimization본 논문은 billion-scale 3DGS training 시 발생하는 GPU VRAM 한계 문제를 해결하기 위해 TideGS를 제안합니다. 기존의 3DGS는 모델 파라미터가 증가함에 따라 메모리 수요가 선형적으로 증가하여, 24GB GPU 기준 약 1,100만 개의 가우시안으로 규모가 제한됩니다 .#Review#3D Gaussian Splatting#Out-of-Core Optimization#Scalable Training#Visibility-induced Sparsity#Trajectory-Adaptive Streaming2026년 5월 19일댓글 수 로딩 중
[논문리뷰] Semantic Generative Tuning for Unified Multimodal Models본 논문은 현대 UMM들이 이해와 생성이라는 두 핵심 과업을 분리된 최적화 경로로 학습함으로써 발생하는 표현적 불일치(Representational misalignment) 문제를 해결하고자 합니다.#Review#Unified Multimodal Models#Generative Tuning#Image Segmentation#Multimodal Alignment#Semantic Proxy#Representation Learning2026년 5월 19일댓글 수 로딩 중
[논문리뷰] SceneCode: Executable World Programs for Editable Indoor Scenes with Articulated Objects본 연구는 기존의 정적인 3D 장면 표현 방식이 실내 공간의 동적 특성과 가동부를 효과적으로 편집하는 데 한계가 있다는 문제 의식에서 출발합니다.#Review#3D Scene Understanding#Executable World Programs#Articulated Objects#Scene Editing#Inverse Graphics#Program Synthesis2026년 5월 19일댓글 수 로딩 중
[논문리뷰] SAGA: A Sequence-Adaptive Generative Architecture for Multi-Horizon Probabilistic Forecasting with Adaptive Temporal Conformal Prediction본 논문은 기존의 microsimulation 모델이 사용하는 parametric 소득 예측 프로세스의 구조적 한계를 해결하고자 합니다.#Review#Deep Sequence Models#Probabilistic Forecasting#Conformal Prediction#Microsimulation#Transformer#Labor Economics2026년 5월 19일댓글 수 로딩 중
[논문리뷰] Process Rewards with Learned Reliability본 논문은 기존 PRM이 중간 단계에 대해 단일 Scalar 보상값만을 제공하여, 해당 점수의 신뢰도를 평가할 수 없는 한계점을 해결하고자 합니다.#Review#Process Reward Model#Beta-Binomial#Adaptive Computation Allocation#Test-Time Scaling#Uncertainty Estimation2026년 5월 19일댓글 수 로딩 중
[논문리뷰] PixVerve: Advancing Native UHR Image Generation to 100MP with a Large-Scale High-Quality Dataset본 논문은 기존 T2I 모델들이 주로 1K~2K 수준의 해상도에 고착되어 있어, 디지털 영화 제작이나 상업 디자인 등에서 요구하는 100MP 수준의 Ultra-High-Resolution(UHR) 생성 능력이 부족한 문제를 해결하고자 한다.#Review#Ultra-High-Resolution#Text-to-Image#100MP#PixVerve-95K#PixVerve-Bench#Diffusion Models2026년 5월 19일댓글 수 로딩 중
[논문리뷰] PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents본 연구는 대규모 외부 컨텍스트를 반복적으로 쿼리하는 LLM 에이전트 환경에서 발생하는 반복적인 오리엔테이션 작업의 비효율성 문제를 해결합니다.#Review#Long-Context LLM Agents#Context Map#Orientation Cache#Prompt Engineering#LLM Inference2026년 5월 19일댓글 수 로딩 중
[논문리뷰] Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning죄송합니다. 제공해주신 논문 URL https://arxiv.org/html/2605.09640을 browse 도구를 사용하여 접근하는 데 실패했습니다. 논문 내용을 가져올 수 없어 요청하신 요약 및 Figure 정보 추출 작업을 수행할 수 없습니다.#Review2026년 5월 19일댓글 수 로딩 중
[논문리뷰] OpenComputer: Verifiable Software Worlds for Computer-Use Agents본 논문은 컴퓨터 사용 에이전트의 훈련과 평가를 저해하는 환경 구축의 어려움과 평가 신뢰성 부족 문제를 해결하기 위해 OpenComputer를 제안한다.#Review#Computer-Use Agents#Verifiable Software Worlds#Verifier-Grounded#Benchmark Synthesis#Desktop Automation#Self-Evolving Verification2026년 5월 19일댓글 수 로딩 중
[논문리뷰] OmniGUI: Benchmarking GUI Agents in Omni-Modal Smartphone Environments본 논문은 기존 GUI 에이전트 벤치마크가 정적 스크린샷 위주로 구성되어 있어, 실시간 환경에서 요구되는 동적 오디오 및 비디오 처리 능력을 평가하지 못한다는 한계를 해결하고자 한다 .#Review#GUI Agents#Multimodal Benchmark#Smartphone Environments#Temporal Reasoning#Auditory Processing#Action Grounding2026년 5월 19일댓글 수 로딩 중
[논문리뷰] Omni-DuplexEval: Evaluating Real-time Duplex Omni-modal Interaction본 논문은 현대의 MLLM이 실시간 환경에서의 상호작용 능력을 평가할 수 있는 표준화된 벤치마크와 평가 방법론이 부족하다는 문제점을 지적합니다.#Review#Multimodal Large Language Models#Real-time Duplex Interaction#Streaming Video Understanding#Benchmark#Proactive Interaction2026년 5월 19일댓글 수 로딩 중