[논문리뷰] MameLoshnLM: Yiddish Language Model and Evaluation Benchmark본 연구는 Yiddish와 같이 역사적으로는 풍부한 문학적 전통을 지녔으나 디지털적으로는 소외된(underrepresented) 언어를 위한 언어 모델 개발의 한계를 해결하고자 한다.#Review#Yiddish#Language Model#Low-Resource#Pretraining#Natural Language Understanding#Benchmark2026년 8월 6일댓글 수 로딩 중
[논문리뷰] MASS: Multiplayer World Models with Authoritative Shared State본 논문은 기존의 비디오 기반 월드 모델들이 다중 플레이어 시나리오에서 겪는 비효율성과 일관성 부족 문제를 해결하는 것을 목적으로 합니다.#Review#Multiplayer World Models#Authoritative Shared State#Logic Engine#Rendering Engine#Video Simulation#Schema-based Architecture#Multi-agent2026년 8월 6일댓글 수 로딩 중
[논문리뷰] Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval본 연구는 기존 LVLM 기반 검색 모델들이 질의 자체에만 의존하여 생성한 CoT가 정작 검색기(retriever)가 왜 실패했는지에 대한 피드백을 반영하지 못한다는 한계를 해결합니다.#Review#Unified Multimodal Retrieval#Retrieval-Centric Chain-of-Thought#Hard Negative Mining#Embedder-Adviser Framework#Group Relative Policy Optimization#Multimodal Reasoning2026년 8월 6일댓글 수 로딩 중
[논문리뷰] Invisible Shortcuts: Why Vision Encoders Know Your Camera본 연구는 현대의 거대한 시각 인코더들이 단순히 의미론적 콘텐츠를 학습하는 것을 넘어, 데이터의 저수준 메타데이터 흔적을 'shortcut'으로 학습한다는 문제를 해결하고자 한다.#Review#Shortcut Learning#Vision Encoders#Metadata Traces#Pretraining#Out-of-Distribution#Data Augmentation#Adversarial Mitigation2026년 8월 6일댓글 수 로딩 중
[논문리뷰] Interpretable MEG Decoding of Perceived Speech: Cortical Sources and the Stimulus Features That Drive Retrieval본 논문은 기존의 고성능 신경망 기반 MEG decoding 모델들이 가지는 '블랙박스'적 한계를 극복하고, 모델이 추출한 정보의 신경과학적 기원을 규명하는 것을 목표로 한다.#Review#Magnetoencephalography#Speech perception#Neural decoding#Interpretable deep learning#Spatial-temporal decomposition#Source localization#Occlusion analysis2026년 8월 6일댓글 수 로딩 중
[논문리뷰] HarnessOpt-Bench: Evaluating LLMs at Harness Optimization본 논문은 LLM 기반 Agent 시스템의 핵심인 Harness를 자동 최적화하는 능력을 측정하기 위한 표준화된 프로토콜인 HarnessOpt-Bench를 제안합니다. 기존 연구들은 각기 다른 시드, 평가 예산, 스코어링 프로토콜을 사용하여 모델 간의 비교가 불가능한 파편화된 환경에 있었습니다 .#Review#Harness Optimization#LLM Agents#Automated Code Optimization#Agentic Systems#Benchmark#Self-Improvement2026년 8월 6일댓글 수 로딩 중
[논문리뷰] GST-Bench: Can VLMs Develop Global Spatial Awareness from Video?본 논문은 기존의 Vision-Language Models(VLMs)이 단일 또는 소수의 이미지 기반 공간 인지 과제에는 능숙하나, 복잡한 비디오 환경에서 요구되는 '글로벌 공간 인지' 능력이 현저히 부족하다는 문제 의식에서 출발한다 .#Review#GST-Bench#Global Spatial Awareness#Video-Language Models#Embodied AI#Spatial Reasoning#VQA2026년 8월 6일댓글 수 로딩 중
[논문리뷰] From Economic Agents to Agentic Economies: A Systems Blueprint for Economic World Models본 논문은 기존의 경제학 연구가 결과물에 대한 '관찰과 설명'에 머물러 있다는 한계를 지적하며, 경제 현상이 모델 내부에서 자생적으로 생성되는 '생성적 설명(Generative Explanation)'의 필요성을 제기합니다 .#Review#Economic World Models#Agentic Economies#Generative Economic Simulation#LLM Agents#Data-Driven Generative Equilibrium#Multi-Agent System2026년 8월 6일댓글 수 로딩 중
[논문리뷰] EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning본 논문은 LLM 에이전트 학습 시 외부 환경과의 상호작용에 의존해야 하는 높은 비용과 검증의 어려움을 해결하는 것을 목표로 합니다.#Review#Agentic Reinforcement Learning#World Modeling#World Rehearsal#Large Language Models#Tool Use#Environment Internalization2026년 8월 6일댓글 수 로딩 중
[논문리뷰] EffectLearner: World-Aware Object-Effect Reasoning for Real-World Video Object Removal본 논문은 기존의 Video Object Removal (VOR) 방법론들이 객체-효과 관계를 암시적으로만 학습하여 실제 환경의 복잡한 물리적 현상을 일반화하는 데 한계가 있다는 점을 지적한다.#Review#Video Object Removal#VLM-based Reasoning#Diffusion Transformer (DiT)#Spatiotemporal Stability#EffectWorld#Motion-aware Mask#Video Editing2026년 8월 6일댓글 수 로딩 중
[논문리뷰] DyPES-VLA: Learning Shared Dynamics Priors and Embodiment-Specific Control for Cross-Embodiment Manipulation본 논문은 다양한 Embodiment를 가진 로봇들 사이에서 범용적으로 적용 가능한 Generalist 정책을 학습하는 것을 목표로 합니다.#Review#Cross-Embodiment#Vision-Language-Action (VLA)#Dynamics Priors#Mixture-of-Experts (MoE)#Future Prediction#Robotics2026년 8월 6일댓글 수 로딩 중
[논문리뷰] DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces본 논문은 현대적인 데이터 분석 환경에서 에이전트의 성능을 신뢰성 있게 평가할 수 있는 통합된 벤치마크가 부재하다는 문제점을 해결하고자 합니다. 기존 연구들은 단순 질의 응답이나 단일 유형의 데이터 소스에만 치중하거나, 결과에 대한 정량적 검증이 부족하다는 한계를 지닙니다 .#Review#Data Agents#Heterogeneous Workspaces#Benchmarking#Verifiable Analytics#Cross-Language#Text-to-SQL#Multimodal Integration2026년 8월 6일댓글 수 로딩 중
[논문리뷰] Continual Learning in Transition본 논문은 전통적인 Continual Learning이 가진 파라미터 중심의 제한된 시각에서 벗어나, LLM 및 Agentic AI 시대에 걸맞은 새로운 시스템 수준의 적응형 패러다임으로의 전환을 목표로 합니다 . 기존 연구들은 주로 정적인 모델 파라미터의 업데이트와 Gradient-based 학습에만 집중해 왔습니다.#Review#Continual Learning#Large Language Models#Agentic AI#Capability Evolution#Parameter-Centric#System-Level Adaptation2026년 8월 6일댓글 수 로딩 중
[논문리뷰] ContextMaster: Interactive Multi-Shot Video Creation via Fixed-Budget Sparse Context Routing본 논문은 현대의 통합 비디오 모델들이 생성, 편집, 참조 기반 생성을 각각 별개의 작업으로 수행하여, 변화하는 창작 상태(evolving creation state)에 대응하지 못하는 한계를 해결하고자 합니다 .#Review#Interactive Multi-Shot Video Creation#Sparse Context Routing#Privileged Context Distillation#Role-aware RoPE#ConstraintSink#Video Diffusion2026년 8월 6일댓글 수 로딩 중
[논문리뷰] ChronoVision: Temporal Reasoning via Latent State Reconstruction본 논문은 멀티모달 대규모 언어 모델(MLLM)이 정적인 인식 작업에는 능숙하지만, 복잡한 물리적 사건의 연속적 변환을 이해하는 시간적 추론 능력은 크게 떨어진다는 문제점을 해결하고자 합니다.#Review#ChronoVision#Temporal Reasoning#Latent State Reconstruction#Vbvr-VQA#Reinforcement Learning#Multimodal Large Language Models2026년 8월 6일댓글 수 로딩 중
[논문리뷰] CalibForge: Adversarial Solver Calibration for Scaling Learnable Terminal Tasks본 논문은 터미널 에이전트 학습을 위한 데이터 구축 시, 단순히 실행 가능한(executable) 과제만으로는 에이전트의 실질적인 학습 효과를 보장하기 어렵다는 점을 지적합니다.#Review#Terminal-Task Synthesis#Adversarial Solver Calibration#Agent Training#Solver-Relative Learnability#Multi-Solver Calibration#Contrastive Solver Calibration2026년 8월 6일댓글 수 로딩 중
[논문리뷰] AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning본 논문은 장기 에이전트 학습(Long-horizon agentic RL)에서 기존의 sparse outcome reward 기반 학습이 가진 크레딧 할당의 불명확성을 해결하고자 합니다 .#Review#Agentic Reinforcement Learning#Self-Distillation#Credit Assignment#Recursive Belief Update#LLM#Policy Optimization2026년 8월 6일댓글 수 로딩 중
[flashinfer] [FlashInfer] Kimi K3 모델을 위한 초고속 Fused KDA Decode 커널 분석 (SM100 최적화)FlashInfer가 Kimi K3의 핵심 연산들을 하나의 SM100 전용 커널로 통합하여 vLLM 대비 1.13배의 성능 향상을 달성했습니다.#CUDA#FlashInfer#LLM#Optimization#SM100#CuTe2026년 8월 5일댓글 수 로딩 중
[flashinfer] FlashInfer의 Blackwell 아키텍처 최적화: CAKE 기반 TinyGEMM2 커널 도입Blackwell(SM100/103) 아키텍처를 위한 고성능 TinyGEMM2 커널을 도입하여 추론 성능을 최대 1.79배 향상시켰습니다.#FlashInfer#CUDA#Blackwell#GEMM#PerformanceOptimization2026년 8월 5일댓글 수 로딩 중
[sglang] SGLang: Wan VAE의 RMSNorm 및 SiLU 연산 융합을 통한 추론 가속Wan VAE의 RMSNorm과 SiLU 연산을 Triton 커널로 융합하여 DecodingStage 성능을 최대 11.5% 개선했습니다.#SGLang#Triton#Optimization#Diffusion#VAE2026년 8월 5일댓글 수 로딩 중