[논문리뷰] ZooWork-ShopRanker: An Open, Preference-Aligned E-Commerce Reranker본 연구는 기존의 범용(general) 웹 리트리버 및 리랭커 모델이 이커머스 환경의 특수성을 고려하지 못해 발생하는 성능 저하 문제를 해결하고자 한다. 단순한 topical relevance를 넘어 소비자 개인의 제약 사항(constraints), 예산, 선호도를 판단하는 능력이 부족한 점이 주요 한계이다.#Review#E-commerce#Reranker#Preference Alignment#Distillation#LLM Judges#SHOPRANK-BENCH2026년 9월 27일댓글 수 로딩 중
[논문리뷰] VLA-Precision: Asymmetric Co-Bootstrapping for Efficient Real-World Online RL of Vision-Language-Action Models본 논문은 대규모 VLA 모델을 기반으로 한 로봇 강화학습 시, 정밀도가 요구되는 실제 환경에서의 신뢰성 부족과 높은 컴퓨팅 오버헤드 문제를 해결하고자 합니다.#Review#Vision-Language-Action Models#Real-world Reinforcement Learning#Asymmetric Co-Bootstrapping#Robot Manipulation#High-precision Control#Online RL#ACoB-Stream2026년 9월 27일댓글 수 로딩 중
[논문리뷰] TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations본 논문은 기존의 포인트 트래킹 모델들이 직면한 sparse 쿼리 포인트 트래킹과 dense 짧은 클립 트래킹 사이의 근본적인 트레이드오프를 해결하고자 합니다.#Review#3D Point Tracking#Dense Tracking#Long Horizon#De-duplication#World-coordinate Representation#Voxelization#3D WAFT2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Tactile-JEPA: Topology-Aware Self-Supervised Representation Learning for Distributed Tactile Sensors로봇이 다양한 작업과 환경에서 일반화(generalization) 능력을 갖추려면 vision-language-action (VLA) 모델이 필수적이지만, 시각 정보만으로는 폐색(occlusion), 정교한 접촉 기반 조작(dexterous contact-rich manipulation), 그리고 취약한 물체와의 상호작용 상황에서 한계가 있다.#Review#Tactile Sensing#Self-Supervised Learning (SSL)#Distributed Tactile Sensors#Topology-Aware Representation#Joint-Embedding Predictive Architecture (JEPA)#Taxel Graph#Multi-scale Masking#Robot Learning2026년 9월 27일댓글 수 로딩 중
[논문리뷰] TRACE: Temporal Audit and Condition-aware Evaluation of Streaming Video UnderstandingI have browsed the paper. Now I will extract the required information and format the output.#Review2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Softmax Reparameterization for Output-Head Quantization본 논문은 Small Language Models (SLMs)에서 large vocabularies가 output heads의 상당한 inference cost를 유발하는 문제를 해결하고자 합니다.#Review#Softmax Reparameterization#Output-Head Quantization#Post-Training Quantization#KL Divergence#Inference Latency#W4 Quantization#Small Language Models#Fidelity2026년 9월 27일댓글 수 로딩 중
[논문리뷰] SLCA-GRPO: Resolving Cross-Segment Credit Misattribution in Tool-Calling RL본 논문은 Tool-calling LLM Agent의 Reinforcement Learning(RL) 과정에서 발생하는 Cross-Segment Credit Misattribution 문제를 해결하고자 합니다.#Review#Tool-Calling RL#Credit Misattribution#Segment-Locked Credit Assignment (SLCA)#Hierarchical Rewards (HierR)#Schema-Guided LLM Simulator (SGLS)#Large Language Models (LLMs)2026년 9월 27일댓글 수 로딩 중
[논문리뷰] SAGE: Mitigating Long-Horizon Reasoning Biases via Topological GuidanceLLM의 Long-Horizon Reasoning은 sparse-reward regimes에서 여전히 핵심적인 도전 과제로 남아 있습니다.#Review#Long-Horizon Reasoning#LLMs#Sparse Rewards#Exploration Bias#Compounding Bias#Symbolic Closure Analysis (SCA)#SAGE#Topological Guidance2026년 9월 27일댓글 수 로딩 중
[논문리뷰] RayOrch: Programming and Executing Lineage-Controlled Multi-Grain Dataflows for Foundation-Model Data PreparationFoundation Model을 위한 고품질 학습 데이터 준비는 이기종 문서나 비디오의 대규모 컬렉션을 구조화된 학습 레코드로 변환하는 확장 가능한 파이프라인을 요구한다.#Review#Foundation Models#Data Preparation#Multi-Grain Dataflows#Lineage Control#Distributed Systems#Ray2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Paragraph Boundaries Are Not White Space:Compression Depth as the Signature of Hierarchical Structure본 연구는 문단(paragraph) 경계가 단순한 공백이 아닌 계층적 구조의 표현임에도 불구하고, 기존의 Transformer 기반 모델들은 이를 1차원적인 reading-order 기반의 위치 정보로만 처리한다는 문제의식에서 출발합니다.#Review#Hierarchical Positional Encoding#hRoPE#Paragraph Boundaries#Attention Compression#Causal Intervention#Long-Document Modeling2026년 9월 27일댓글 수 로딩 중
[논문리뷰] MOPD-Router: Rethinking Teacher Routing in Multi-Teacher On-Policy Distillation본 논문은 기존 MOPD에서 도메인 라벨에 의존하는 Domain-label hard routing의 한계를 극복하는 것을 목표로 합니다.#Review#Multi-teacher On-Policy Distillation#Teacher Routing#LLM Post-training#ExpertAlign#Token-level Routing#Reinforcement Learning2026년 9월 27일댓글 수 로딩 중
[논문리뷰] LightMIS: Ultra-Lightweight Medical Image Segmentation Without a Stage-Wise Decoder본 논문은 정밀한 의료 영상 분할을 수행하면서도 자원이 제한된 환경에서 실시간 추론이 가능한 초경량 모델의 필요성을 해결하고자 합니다. 기존의 U-Net 기반 모델들은 고성능을 보이지만 복잡한 Stage-wise decoder 구조로 인해 계산 및 메모리 비용이 높다는 한계가 있습니다.#Review#Medical Image Segmentation#Ultra-Lightweight#Convolutional Neural Networks#Decoder-free#Feature Fusion#On-device Inference2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Jev in the Wild: A Data-Driven Analysis of the Jev Model's Functionality, Applications and Ecosystem본 연구는 Jev 모델의 초기 공개 생태계가 어떻게 진화하고 다양한 애플리케이션에서 실제로 어떻게 활용되는지 명확히 파악하는 것을 목표로 합니다. 많은 애플리케이션이 빈번하고 경량(lightweight)의 의사결정을 요구하지만, 기존 모델들은 이러한 필요를 완전히 충족하지 못하고 있습니다.#Review#Jev Model#Ecosystem Analysis#Decision Models#GitHub Projects#Usage Patterns#Public Attention#Zero-Shot Inference2026년 9월 27일댓글 수 로딩 중
[논문리뷰] InternW0-Δ: A World Action Model Bridging Predictive Dynamics and Actions with 20K+ Hours of Open Data범용적인 로봇 조작을 위한 World Action Models (WAMs)는 시각적 Dynamics와 로봇 Actions을 Jointly Modeling하는 유망한 접근 방식을 제공합니다.#Review#World Action Models#Robot Manipulation#Predictive Dynamics#Causal Imprint#Mixture-of-Transformers#4D-aware Distillation#Heterogeneous Data2026년 9월 27일댓글 수 로딩 중
[논문리뷰] IndicBankBench: Evaluating Safety and Reliability of Language Model Assistants in Indian Retail Banking본 연구는 retail-banking assistant의 안전성과 신뢰성 평가에 있어 기존 benchmark의 한계를 지적하며, 특히 인도 retail banking 환경에 특화된 포괄적인 평가 프레임워크인 IndicBankBench를 제안합니다.#Review#LLM Assistant#Retail Banking#Benchmarking#Safety#Reliability#Tool Use#Failure Diagnostics#Strict Pass2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Game Arena: Strategic LLM Evaluation in Competitive Environments현대 AI 연구에서 LLM 평가를 위해 사용되는 MMLU, GSM8K와 같은 정적 벤치마크는 데이터 오염과 성능 포화(saturation) 문제로 인해 모델 간의 변별력을 상실하고 있습니다.#Review#Large Language Models#Benchmarking#Competitive Games#Strategic Evaluation#Game Theory#Multi-agent Systems#Infrastructure2026년 9월 27일댓글 수 로딩 중
[논문리뷰] FuseReg: Regularizing Layer Fusion Mitigates the Reconstruction-Generation Gap in Representation AutoencodersRepresentation Autoencoders (RAEs)는 Pretrained visual encoder의 Feature를 활용하여 이미지 생성 모델에 강력한 시각적 표현을 통합하지만, Latent space를 형성할 Encoder layer 선택에서 Trade-off에 직면한다.#Review2026년 9월 27일댓글 수 로딩 중
[논문리뷰] FoMo: Forking Moment in Generative Trajectory as a Perceptual Distance본 논문은 Reference-based IQA metric 학습 시 필요한 human-annotated data 수집의 한계점을 해결하고자 한다.#Review2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Evidence-Grounded Auditing of Identification Assumptions in Climate-Policy Causal EvaluationsDifference-in-differences (DID) 연구는 탄소 가격 책정 및 배출권 거래제와 같은 climate policy를 평가하는 데 광범위하게 사용됩니다.#Review#Climate Policy#Causal Evaluation#Difference-in-Differences (DID)#Identification Assumptions#Large Language Models (LLMs)#Evidence-Grounded Auditing#Flaw Injection#Research Reliability2026년 9월 27일댓글 수 로딩 중
[논문리뷰] Enhancing Photogrammetric Digital Surface Models with Pretrained Diffusion Models and Multimodal Conditioning본 논문은 스테레오-사진측량(stereo-photogrammetry)으로 생성된 Digital Surface Models (DSMs)의 낮은 품질 문제를 해결하기 위해 Diffusion Models를 제안한다.#Review2026년 9월 27일댓글 수 로딩 중