[triton] Triton FP4 레이아웃 변환 최적화: 불필요한 메모리 할당 및 복사 제거Triton 라이브러리에서 FP4 데이터 타입의 레이아웃 변환 시 발생하는 비효율성을 제거하여 메모리 사용량과 실행 시간을 개선합니다.#Triton#FP4#최적화#메모리 관리#성능 개선2026년 8월 28일댓글 수 로딩 중
[Liger-Kernel] Liger-Kernel의 Fused Linear Cross Entropy 성능 최적화: C=16 전략Triton 커널의 메모리 버짓 상수를 조정하여 Fused Linear Cross Entropy 연산의 루프 오버헤드를 획기적으로 줄인 사례 분석.#Triton#LLM#Optimization#Performance#Liger-Kernel2026년 8월 27일댓글 수 로딩 중
[vllm] vLLM, FlashInfer BF16 CuTeDSL GEMM 통합으로 저지연 추론 성능 향상vLLM이 FlashInfer BF16 CuTeDSL GEMM을 통합하여 저지연 추론 성능을 개선했습니다.#vLLM#FlashInfer#BF16#GEMM#최적화#딥러닝 추론2026년 8월 27일댓글 수 로딩 중
[vllm] vLLM, CUDA 네이티브 SwiGLU 커널 도입으로 Humming MoE 성능 1.4% 향상vLLM이 Humming MoE에서 CUDA 네이티브 SwiGLU 커널을 사용하여 처리량을 1.4% 개선했습니다.#vLLM#성능 최적화#CUDA#MoE#SwiGLU2026년 8월 27일댓글 수 로딩 중
[vllm] vLLM의 Hopper(SM90) 아키텍처를 위한 GEMM 커널 최적화NVIDIA H200(SM90) GPU에서 Kimi-K3 모델의 GEMM 연산 성능을 최대 1.97배 향상시킨 최적화 사례 분석.#vLLM#GEMM#Hopper#CUDA#PerformanceOptimization2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization본 논문은 범용적인 로봇 조작(robotic manipulation)을 위해 unseen task에 대한 Zero-shot cross-task generalization을 달성하는 것을 목표로 합니다.#Review#Robotic Manipulation#In-Context Learning#World-Action Modeling#Zero-shot Generalization#Human Video Guidance#HumanGen Dataset2026년 8월 27일댓글 수 로딩 중
[논문리뷰] WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution본 논문은 에이전트의 경험이 최적화 히스토리에 파편화되어 축적되는 문제를 해결하고자 한다. 기존 연구들은 기술을 반복적으로 개발하지만, 이를 뒷받침하는 지식의 조직화가 부족하여 학습한 내용을 시스템적으로 재사용하는 데 한계가 있다.#Review#AI Agents#Skill Evolution#Persistent Knowledge#LLM#Agentic Workflow#Knowledge Consolidation2026년 8월 27일댓글 수 로딩 중
[논문리뷰] What Makes Good Agentic Data? An ACE Lens on Data Generation for LLM Agents본 논문은 LLM 에이전트 학습을 위한 데이터 생성 과정이 직면한 일관성 유지 문제와 데이터의 질적 관리의 모호함을 해결하고자 합니다. 기존 연구들은 도메인별로 파편화되어 있어, 에이전트의 상호작용 데이터 생성 메커니즘을 통합적으로 이해하는 데 어려움을 겪고 있습니다 .#Review#LLM Agents#Agentic Data#Data Generation#Accuracy#Complexity#Diversity#ACE Lens2026년 8월 27일댓글 수 로딩 중
[논문리뷰] What Does an Evaluation License? A Commit-Bound Census of Claim-Relative Inference in Inspect Evals본 논문은 기존의 평가 아티팩트(Evaluation Artifact)들이 단순히 수치적인 결과값만을 보고할 뿐, 해당 결과가 어떤 데이터와 해석을 바탕으로 도출되었는지에 대한 '재현 가능성(Claim-replay)'을 보장하지 못한다는 문제를 제기합니다 .#Review#Inspect Evals#Claim-Relative Inference#Evidence Gate#Semantic Multiplicity#Audit Contract#Reproducibility#Finite Frame2026년 8월 27일댓글 수 로딩 중
[논문리뷰] UrbanGround: From Local Perception to Spatial Agency in a Real-Scale City본 논문은 Multimodal Large Language Models (MLLMs) 에이전트가 고립된 장면 인식에는 능숙하지만, 복잡한 실세계 도시 환경에서 이동하며 지속적인 spatial agency를 발휘할 수 있는지에 대해 의문을 제기합니다.#Review#Multimodal Large Language Models#Spatial Agency#UrbanGround#Embodied Navigation#Geospatial Data#Closed-Loop Interaction#3D Sandbox2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Understanding Evolution Strategies for LLM Reasoning: Broader Reasoning Coverage than GRPO본 논문은 LLM reasoning 후학습(post-training)에서 ES가 GRPO와 비교하여 어떠한 최적화 동역학(dynamics)과 장점을 갖는지 체계적으로 분석합니다.#Review#Evolution Strategies#GRPO#LLM Reasoning#Pass@K#Entropy Collapse#Policy Diversity#Catastrophic Forgetting2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Training Agents to Evolve with Their Harness: TaoLive Digital Avatar Agent Technical Report본 연구는 라이브 커머스 환경에서 실시간 대응이 필요한 디지털 아바타 에이전트가 고정된 Harness에 과적합되어 Harness 변화 시 성능이 급격히 저하되는 문제를 해결하고자 합니다.#Review#Harness-Aware Training#Digital Avatar#Harness Evolution#Surface-form Overfitting#On-Policy Distillation#Agentic RL2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Thinking on Shots: Consistent Multi-Shot Video Editing with Agentic Reasoning본 논문은 기존의 영상 편집 모델들이 가진 '무분별한 청킹(blind chunking)' 전략의 한계를 극복하기 위해 MMLVE 과제를 제안한다 .#Review#Multi-Shot Video Editing#Agentic Reasoning#Cross-Shot Editing Consistency#Multi-Instruction Decoupling#Spatiotemporal Structure2026년 8월 27일댓글 수 로딩 중
[논문리뷰] TacForcing: Streaming Action Generation with Execution-Time Tactile Feedback본 논문은 contact-rich manipulation 환경에서 초기 관측치 기반의 VLA 모델이 겪는 실행 시점의 촉각 정보 불일치 문제를 해결하고자 합니다.#Review#Tactile Feedback#Streaming Action Generation#Flow Matching#Vision-Language-Action Models#Robot Manipulation#Execution-Aware Tactile Attention2026년 8월 27일댓글 수 로딩 중
[논문리뷰] TTPO: Test-Time Policy Optimization본 논문은 LLM의 test-time reasoning 능력을 향상시키기 위한 test-time training(TTT) 환경에서 ground-truth label 부재 문제를 해결합니다. 기존의 OPSD나 RLVR 기법은 정답을 필수로 요구하지만, test-time에는 이러한 정보를 얻을 수 없습니다.#Review#Test-Time Policy Optimization#Test-Time Training#On-Policy Self-Distillation#Reinforcement Learning#Chain-of-Thought#Mathematical Reasoning#Asymmetric Objective2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Self-OPD: On-Policy Distillation for Flow Matching Models without Teacher본 논문은 기존의 Flow Matching 모델 정렬(alignment) 방식이 가진 높은 컴퓨팅 비용과 성능 한계를 해결하기 위해 Self-OPD를 제안합니다.#Review#Flow Matching#On-Policy Distillation#Teacher-Free Alignment#Multi-Objective Optimization#Self-Exploration#Reward-Level Fusion2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Procedura: Agentic 3D Modeling with Procedural Control기존의 Native 3D generators는 고품질 메시를 생성할 수 있으나, 정교한 기계적 구조를 표현하는 데 한계가 있으며, 생성된 결과물이 부품 단위로 분해되지 않거나 편집이 불가능하다는 문제점이 있습니다.#Review#3D Modeling#Agentic Framework#Procedural Assembly#CSG#Large Language Models#Typed Mates#Parametric Program2026년 8월 27일댓글 수 로딩 중
[논문리뷰] PILOT in the Loop: Live Self-Improvement for Long-Horizon Agents본 논문은 Long-horizon 에이전트가 긴 작업 시간 동안 생성하는 풍부한 경험을 실시간으로 활용하지 못하는 기존의 한계를 해결하고자 합니다.#Review#Long-Horizon Agents#Live Self-Improvement#Supervisor-Worker Harness#Live Steering#Live Self-Evolution#Agentic Workflow2026년 8월 27일댓글 수 로딩 중
[논문리뷰] PAWBench: How Far Are We from Probabilistically Aligned World Modeling?본 논문은 최신 비디오 생성 모델들이 단순한 시각적 품질을 넘어 World Models로 인식되고 있으나, 정작 확률적 정렬(Probabilistic Alignment) 측면에서는 제대로 평가받지 못하고 있다는 문제의식에서 출발한다 .#Review#Probabilistic Alignment#World Modeling#Video Generation#PAWBench#PAWEval#Calibration#Coverage2026년 8월 27일댓글 수 로딩 중
[논문리뷰] Magpie: Real-Time World Renderer for Interactive Games본 논문은 기존 게임 그래픽 파이프라인의 고비용 구조를 극복하고, 게임 엔진의 핵심인 게임플레이 디자인의 재현성을 유지하며 시각적 자유도를 높이기 위해 Magpie를 제안합니다.#Review#Generative World Renderer#Interactive Games#White-box Rendering#Gameplay Design#Autoregressive Inference2026년 8월 27일댓글 수 로딩 중