[논문리뷰] FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving본 논문은 Long-context LLM의 prefilling 단계에서 발생하는 self-attention의 quadratic complexity 병목 문제를 해결하기 위해 FlashPrefill V2를 제안합니다.#Review#Long-context LLM#Sparse Attention#FlashAttention#FP8 Inference#KV Cache#LLM Serving2026년 8월 20일댓글 수 로딩 중
[논문리뷰] FACET: Preserving Source Intent and Executable State in Terminal Task Synthesis본 연구는 터미널 에이전트 학습에 필요한 고품질의 실행 가능한 데이터셋 합성이 가진 정보 손실 및 Artifact 간 일관성 문제를 해결하고자 합니다.#Review#Terminal Task Synthesis#Agentic Scenario Reconstruction#Executable-State Grounding#Task Artifact Consistency#Terminal-Bench 2.1#Fine-grained Supervision2026년 8월 20일댓글 수 로딩 중
[논문리뷰] EnvHarness: Awakening Static Worlds for Agent Learning본 논문은 정적이고 hand-built된 기존의 에이전트 학습 환경이 에이전트의 발전 속도를 따라가지 못하고, 특정 취약점에 대한 타겟팅된 학습 신호를 제공하지 못한다는 한계를 지적합니다.#Review#LLM Agents#Environment Engineering#EnvHarness#EnvRigger#Task-Policy-Conditioned#Co-evolution2026년 8월 20일댓글 수 로딩 중
[논문리뷰] EXIMO: VLM Guided Exploration of VLA Policies본 논문은 사전 학습된 VLA 정책을 새로운 long-horizon 과업에 대해 sample-efficient하게 파인튜닝하는 문제를 해결합니다.#Review#VLM#VLA#Robotic Manipulation#Reinforcement Learning#Sample Efficiency#Policy Finetuning#Distillation2026년 8월 20일댓글 수 로딩 중
[논문리뷰] Chain-of-Experience for Continual LLM Improvement본 논문은 현대의 LLM들이 학습 후 고정된 상태로 배포되어 매 추론을 고립된 이벤트로 처리함으로써 추론 단계에서의 지속적 개선 능력을 상실하고 있다는 점을 문제로 지적합니다.#Review#Chain-of-Experience#Test-time Improvement#LLM#Iterative Feedback#Continual Learning#Reasoning Efficiency2026년 8월 20일댓글 수 로딩 중
[논문리뷰] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video본 논문은 uncalibrated monocular video로부터 reconstruction-grade의 4D human avatar를 재구성하는 난제를 해결하기 위해 제안되었습니다.#Review#Multiview Video Generation#4D Human Reconstruction#4D Gaussian Splatting#Reference Context Packing#Target Context Routing#3D-Aware Skeleton Conditioning2026년 8월 20일댓글 수 로딩 중
[LlamaFactory] Qwen3.5 모델의 GDN 선형 어텐션에 대한 시퀀스 병렬 처리 및 Pack 지원 추가Qwen3.5 모델의 GDN 선형 어텐션 레이어에 시퀀스 병렬 처리와 Pack 기능을 적용하여 GPU 활용도를 높였습니다.#LLM#Qwen3.5#Sequence Parallel#Context Parallel#GDN#Flash Attention#Optimization2026년 8월 20일댓글 수 로딩 중
[flashinfer] Blackwell 아키텍처를 위한 MXFP8/MXFP4 기반 고성능 MoE 추론 최적화FlashInfer의 SM100 W4A8 백엔드 추가로 MXFP8/MXFP4 혼합 정밀도 추론 성능 및 통신 효율 대폭 개선#FlashInfer#MoE#Blackwell#MXFP8#CuTeDSL#LLM2026년 8월 20일댓글 수 로딩 중
[flashinfer] NVIDIA Blackwell 아키텍처를 위한 FlashInfer의 Router GEMM 최적화FlashInfer가 NVIDIA Blackwell GPU에서 Router GEMM 연산 성능을 1.1x 이상 향상시킨 최적화 PR 분석#NVIDIA Blackwell#Router GEMM#FlashInfer#GPU 최적화#성능 향상#딥러닝2026년 8월 20일댓글 수 로딩 중
[flashinfer] DeepSeek-V3 라우팅의 혁신: FlashInfer의 Cake 백엔드 가속 분석Blackwell 아키텍처에서 DeepSeek MoE 라우팅 성능을 최대 1.55배 끌어올린 Cake 백엔드의 PTX 최적화 기법을 살펴봅니다.#CUDA#DeepSeek#MoE#FlashInfer#Blackwell#Performance2026년 8월 20일댓글 수 로딩 중
[flashinfer] FlashInfer에 NVIDIA Rubin(SM107) 및 Blackwell FP8 GEMM 지원 추가CuTe DSL을 활용한 NVIDIA Rubin 아키텍처 지원 및 Blackwell용 고성능 FP8 GEMM 커널 구현 최적화.#FlashInfer#NVIDIA#Rubin#Blackwell#GEMM#FP8#CuTeDSL2026년 8월 20일댓글 수 로딩 중
[논문리뷰] Zetta ζ: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence본 논문은 Frozen Foundation Models 기반의 Embodied Agents가 물리적 환경에서 겪는 Open-Loop 실행의 한계와 실시간 교정 능력의 부재를 해결하기 위해 Zetta를 제안합니다 .#Review#Embodied AI#Closed-Loop Execution#Self-Evolving#Physical Intelligence#Harness#VLA2026년 8월 19일댓글 수 로딩 중
[논문리뷰] Training Leaves Traces: Centered Residual Signatures for Language Model Lineage Verification본 논문은 Open-weight language model의 파생 여부를 weight만으로 판별하는 데이터 독립적(data-free)인 white-box lineage verification 문제를 정의하고 해결한다.#Review#Model Lineage Verification#Residual Signatures#Weight-level Ancestry#Trace Concentration#Checkpoint Laundering#Identity Alignment2026년 8월 19일댓글 수 로딩 중
[논문리뷰] Training Chemical Plausibility-Aware Large Language Models for Single-Step Retrosynthesis본 논문은 SSRS 모델의 고질적인 'one-to-many' 특성이 단일 정답 위주의 벤치마킹 환경에서는 충분히 포착되지 않는다는 문제점을 해결하고자 합니다.#Review#Retrosynthesis#Large Language Models#Chemical Plausibility#ChemCensor#Top-KK Prompting#Drug Discovery#C3LM2026년 8월 19일댓글 수 로딩 중
[논문리뷰] The More Popular, The Harder to Forget: Adaptive Popularity for LLM Unlearning본 논문은 기존의 LLM 언러닝 기법들이 학습 데이터의 빈도나 사실의 인기도를 고려하지 않고 모든 fact에 대해 균일한 gradient 압력을 가함으로써 발생하는 'Popularity Gap' 문제를 해결하고자 합니다 .#Review#Machine Unlearning#LLM#Popularity Bias#Gradient Ascent#Dual-Ascent Controller#Parametric Memorization2026년 8월 19일댓글 수 로딩 중
[논문리뷰] Temporal Multi-Signal Fusion for Token-Level Hallucination Detection본 논문은 Large Language Models (LLMs)이 유창하지만 종종 사실과 다른 텍스트를 생성하는 문제, 특히 Retrieval-Augmented Generation (RAG) 시스템에서 단일 환각 주장이 중요한 하류 결정에 치명적인 영향을 미칠 수 있음에 주목합니다.#Review#Hallucination Detection#Large Language Models (LLMs)#Sequence Labeling#Temporal Multi-Signal Fusion#Retrieval-Augmented Generation (RAG)#Token-Level2026년 8월 19일댓글 수 로딩 중
[논문리뷰] SoftVTBench: A Deformation-Aware Visuo-Tactile Dataset and Benchmark for Deformable-Object Manipulation본 논문은 기존 로봇 조작 벤치마크들이 과업 완료(Task Success) 여부만 평가하여, 실제 물리적 상호작용의 질적 수준을 간과하고 있다는 문제점을 해결하고자 합니다 .#Review#Deformable-Object Manipulation#Visuo-Tactile#Dataset#Benchmark#Deformation-aware Success Rate#Finite-Element Method (FEM)2026년 8월 19일댓글 수 로딩 중
[논문리뷰] SkillGate: Training In-Policy Skill Selection in Long-Horizon Agents본 논문은 에이전트가 중도에 스스로 스킬을 선택하는 In-policy skill selection 과정에서 발생하는 효율성 저하 문제를 해결합니다. 기존의 보상 기반 RL은 실행 단계의 outcome에만 집중하여, 정작 중요한 선택 단계에 기여하는 토큰들에게는 거의 학습 신호가 전달되지 않는다는 치명적인 한계가 있습니다.#Review#In-Policy Skill Selection#Long-Horizon Agents#Reinforcement Learning#Credit Assignment#Policy Gradient#Agentic Benchmarks2026년 8월 19일댓글 수 로딩 중
[논문리뷰] SemaPLC: A Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation본 논문은 기존의 LLM 기반 PLC 코드 생성 연구들이 주로 독립적인 POU 단위의 생성에 머물러 있어, 실제 산업 현장에서 필수적인 프로젝트 통합성과 정확한 런타임 동작을 보장하지 못한다는 문제를 해결하고자 한다.#Review#PLC#Code Generation#Agentic Workflow#Project Grounding#Formal Verification#Runtime Validation#IEC 61131-32026년 8월 19일댓글 수 로딩 중
[논문리뷰] SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation본 연구는 현존하는 Video Generation 모델들이 시각적 품질이나 시간적 일관성은 뛰어나지만, 사용자의 구체적인 작업 목표를 달성하는 능력은 제대로 평가받지 못하고 있다는 문제 인식에서 출발합니다.#Review#Semantic Task Completion#Video Generation#Semantic Grounding#Outcome Achievement#Generation Reliability#VLM-based Evaluation2026년 8월 19일댓글 수 로딩 중