[논문리뷰] Entropy as a Structural Prior: How a Log-Barrier on DiT Belief Space Drives Musical Diversity and Development본 논문은 확산 모델(Diffusion Model) 학습 시 확신에 기반한 그래디언트 가중치 부여가 모델의 오류를 증폭시킬 수 있다는 기존의 고정관념을 반박하고, 이를 통해 구조적 이점을 얻을 수 있음을 입증합니다.#Review#Diffusion Models#Belief Space#Music Generation#LoRA#Implicit Curriculum#Entropy#Log-Barrier2026년 6월 7일댓글 수 로딩 중
[논문리뷰] Direct 3D-Aware Object Insertion via Decomposed Visual Proxies본 연구는 기존의 Object insertion 기술이 2D image plane에 국한되어 있어, 사용자가 원하는 물체의 3D pose를 정밀하게 제어하지 못하는 한계를 해결하고자 합니다.#Review#Object Insertion#Pose-Controllable#Decomposed Visual Proxies#3D-Aware#Diffusion Model#Image Synthesis2026년 6월 7일댓글 수 로딩 중
[논문리뷰] Critic-R: Improving Agentic Search using Instruction-tuned Retrievers with Natural Language Introspective Feedback본 논문은 Agentic Search 환경에서 기존 Retriever의 경직성이 전체 시스템 성능의 병목 현상(bottleneck)을 유발한다는 점을 해결하고자 합니다. 기존 연구들은 주로 Reasoning Agent만을 최적화하거나, Retriever를 고정된 블랙박스로 간주하는 한계를 보입니다.#Review#Agentic Search#Retrieval-Augmented Generation#Instruction-tuned Retriever#Inference-time Scaling#Contrastive Learning#Introspective Feedback2026년 6월 7일댓글 수 로딩 중
[논문리뷰] Compress-Distill: Reasoning Trace Compression for Efficient Knowledge Distillation본 논문은 최신 Reasoning 모델들이 생성하는 긴 Chain-of-Thought 추론 과정이 Distillation 시 비용을 크게 증가시키고, Student 모델이 지나치게 장황한 답변을 생성하도록 유도한다는 점에 주목합니다.#Review#Knowledge Distillation#Chain-of-Thought#Reasoning Trace#Model Compression#Supervised Fine-tuning#Inference Efficiency#Large Language Models2026년 6월 7일댓글 수 로딩 중
[논문리뷰] Augmenting Attention with Exponentially Decaying Memory Improves Query-Aware KV Sparsity본 논문은 Long-context LLM의 추론 효율성을 높이기 위한 기존 Query-aware sparse inference 기법들의 성능 한계를 극복하는 것을 목표로 한다.#Review#Efficient Inference#Query-Aware Sparsity#KV-cache#Exponentially Decaying Memory#RAT+#Long-Context LLM2026년 6월 7일댓글 수 로딩 중
[논문리뷰] AnchorWorld: Embodied Egocentric World Simulation with View-based Evolution Customization기존의 interactive world model들은 주로 키보드/마우스 입력이나 단순한 텍스트 프롬프트에 의존하여, 인간의 실제 동작(full-body motion)에 기반한 자연스러운 상호작용을 반영하지 못하는 한계가 있습니다.#Review#Embodied AI#Egocentric World Simulation#World Customization#Human Action Control#Anchor-View Priors#Video Generation2026년 6월 7일댓글 수 로딩 중
[vllm] vLLM의 GDN 어텐션 최적화: Prefill과 Decode 배치 분리를 통한 2배 성능 향상Mixed 배치에서 Prefill과 Decode를 분리하여 GDN 어텐션 연산 효율을 극대화하고 1.93배의 커널 속도 향상을 달성했습니다.#vLLM#LLM#Performance#Optimization#CUDA#GDN2026년 6월 6일댓글 수 로딩 중
[sglang] UniPC 스케줄러에서 GPU 동기화 제거를 통한 성능 최적화 분석UniPC 스케줄러의 GPU 동기화 오버헤드를 제거하여 성능을 개선한 코드 변경 분석.#PyTorch#Optimization#GPU#UniPC Scheduler#sglang2026년 6월 6일댓글 수 로딩 중
[hermes-agent] CLI 사용자 경험 개선: 백그라운드 캐시 워밍을 통한 모델 선택기 응답 속도 최적화사용자 입력 전 백그라운드에서 모델 캐시를 미리 로드하여 /model 명령어 응답 시간을 1.5초에서 136ms로 단축했습니다.#Python#Performance#CLI#Optimization#Async2026년 6월 5일댓글 수 로딩 중
[sglang] [SGLang] LingBot 실시간 서빙 최적화: 카메라 컨디셔닝 캐싱과 전송 프로토콜 개선LingBot의 실시간 지연시간을 10% 이상 단축시킨 카메라 컨디셔닝 캐싱 및 전송 레이어 최적화 기법을 살펴봅니다.#SGLang#Diffusion#Optimization#Realtime#PyTorch#Performance2026년 6월 5일댓글 수 로딩 중
[uv] uv, 대규모 워크스페이스 탐색 속도 1.8배 향상: 중복 파일 읽기 제거uv가 대규모 워크스페이스 탐색 시 pyproject.toml 파일을 중복으로 읽는 문제를 해결하여 성능을 크게 개선했습니다.#uv#성능 최적화#Rust#Python#빌드 도구2026년 6월 5일댓글 수 로딩 중
[cpython] CPython 내부 들여다보기: logging.getLogger()는 어떻게 33% 더 빨라졌나?CPython의 logging 모듈이 락 프리(lock-free) 패스트 패스를 도입하여 기존 로거 조회 성능을 33% 개선한 과정을 분석합니다.#Python#CPython#Performance#Optimization#Logging2026년 6월 4일댓글 수 로딩 중
[sglang] 실시간 RGB 전송 속도 향상을 위한 최적화 분석sglang의 실시간 RGB 전송에서 불필요한 압축을 제거하여 성능을 22.4% 향상시킨 PR 분석#sglang#최적화#성능 개선#실시간 전송#RGB#Gzip2026년 6월 4일댓글 수 로딩 중
[flashinfer] FlashInfer의 MoE Routing 성능 최적화: Batcher's Odd-Even Merge Sort 도입FlashInfer의 MoE Top-K 연산에서 64비트 리덕션 최적화 및 비-2의 거듭제곱 정렬을 Batcher's 네트워크로 개선하여 성능을 극대화했습니다.#FlashInfer#CUDA#MoE#Optimization#GPU#Sorting2026년 6월 4일댓글 수 로딩 중
[ray] Ray Data의 hash_partition 성능을 7배 향상시킨 최적화 전략PyArrow의 sort_indices와 zero-copy 슬라이싱을 활용하여 Ray Data의 hash_partition 성능을 대폭 개선한 사례를 분석합니다.#Ray#PyArrow#Performance#DataEngineering#Optimization2026년 6월 4일댓글 수 로딩 중
[논문리뷰] World-Language-Action Model for Unified World Modeling, Language Reasoning, and Action Synthesis본 논문은 기존의 WAM (World-Action Model)과 VLA (Vision-Language-Action Model)가 가진 한계를 극복하기 위해 제안되었다.#Review#Embodied AI#World Modeling#Language Reasoning#Action Synthesis#Autoregressive Transformer#Test-Time Scaling#Cross-Embodiment2026년 6월 4일댓글 수 로딩 중
[논문리뷰] VideoKR: Towards Knowledge- and Reasoning-Intensive Video Understanding본 논문은 현대의 멀티모달 모델들이 단순한 시각적 인식을 넘어 전문적인 도메인 지식과 다단계 추론이 필요한 비디오 이해 태스크에서 한계를 보인다는 점을 지적한다.#Review#Video Understanding#Knowledge-Intensive Reasoning#Training Corpus#CoT#Benchmark#Skill-Oriented#Reinforcement Learning2026년 6월 4일댓글 수 로딩 중
[논문리뷰] Video2LoRA: Parametric Video Internalization for Vision-Language Models본 논문은 기존 VLM 기반 비디오 이해 모델들이 겪는 고질적인 컨텍스트 윈도우 병목 현상과 과도한 토큰 소비 문제를 해결하고자 합니다. 기존 방식은 프레임별로 수백 개의 시각 토큰을 컨텍스트에 삽입해야 하므로, 영상 길이가 길어지거나 질의가 반복될 때마다 메모리와 Latency 부담이 기하급수적으로 증가합니다 .#Review#Video-Language Models#Low-Rank Adaptation#Hypernetwork#Video Internalization#Inference Efficiency#Parametric Knowledge Compression#Perceiver2026년 6월 4일댓글 수 로딩 중
[논문리뷰] Unsupervised Skill Discovery for Agentic Data Analysis본 논문은 데이터 분석 에이전트의 성능 향상을 위한 효과적인 스킬을 지도 학습 없이 발견하는 문제를 다룬다. 데이터 분석 작업은 도메인과 데이터 형식이 다양하여 표준화된 파이프라인 적용이 어렵고, 성공 여부를 판단하기 위한 신뢰성 있는 지도 데이터(Annotation)를 획득하는 데 큰 비용이 발생한다.#Review#Agentic Data Analysis#Unsupervised Skill Discovery#Inference-time Augmentation#LLM Agent#Adaptive Checklist Verifier#Answer Agreement Verifier2026년 6월 4일댓글 수 로딩 중
[논문리뷰] Towards Truly Multilingual ASR: Generalizing Code-Switching ASR to Unseen Language Pairs본 연구는 코드 스위칭 ASR 시스템이 소수의 학습된 언어 쌍을 넘어 보지 못한 언어 쌍으로 범용성을 확장할 수 있는지 검증합니다.#Review#Automatic Speech Recognition (ASR)#Code-Switching (CS)#Model Merging#Domain Generalization#Multilingual ASR#Generalization2026년 6월 4일댓글 수 로딩 중