[논문리뷰] Harness-G: A Graph-Structured Harness for Search Agents본 논문은 현재의 LLM 기반 검색 에이전트들이 사용하는 자유 형식 query 생성 방식이 RL 최적화 과정에서 심각한 비효율을 초래함을 지적한다.#Review#Search Agents#Retrieval-Augmented Generation#Reinforcement Learning#Graph-Structured Retrieval#Action Menu#Credit Assignment#Retrieval-Equivalence Collapse2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering본 연구는 AI 시스템이 스스로를 구축하고 최적화하는 AI4AI의 실현을 위해, 구체적인 실행 피드백 기반의 MLE 환경과 반복적 개선 루프를 결합하는 것을 목표로 합니다.#Review#Recursive Self-Improvement#Machine Learning Engineering#OpenMLE#Meta-Evolution#AI4AI#Evolutionary Search2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Flux-OPD: On-Policy Distillation with Evolving Contexts본 논문은 오픈 도메인(open-ended domains) 환경에서 검증 가능한 보상(verifiable rewards)이 결여되어 작업 선호도를 명시적으로 학습하기 어렵다는 문제를 해결하고자 합니다.#Review#On-Policy Distillation#Evolving Contexts#Context Distillation#Reverse KL Decomposition#Open-Ended Domains#Task Preferences2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability본 논문은 LLM 에이전트가 사용하는 Filesystem-Based Memory의 관리 및 지속 가능성에 관한 체계적인 탐구를 제안합니다.#Review#LLM Agents#Filesystem-Based Memory#Agent Memory#Organization#Sustainability#Declarative Memory#Procedural Skills2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations본 논문은 LLM이 학습 데이터 내의 사회적 편향을 구조적으로 내재화하는 문제를 해결하기 위해, 모델의 일반적 능력을 저하시키지 않으면서 편향만을 정밀하게 제거하는 효율적인 방안을 탐색합니다.#Review#Large Language Models#Demographic Bias#Mechanistic Interpretability#Neural Pruning#GLU-MLP#Differential Activation2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Explorative Modeling: Unlocking a Third Pretraining Axis and End-to-End Generation본 논문은 기존의 고성능 생성 모델들이 고착화된 모델링 구조로 인해 완전한 End-to-End 학습을 수행하지 못하고 있다는 문제를 제기한다.#Review#Generative Modeling#Explorative Modeling#End-to-End#Mode Forcing#Generative Expressivity#Pretraining Axis2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Echoverse: Deep, Evolving Environments for Training Computer-Use Agents at Scale본 논문은 기존의 Live-web 기반 벤치마크가 Computer-Use Agent 학습 및 평가에 가지는 근본적인 한계를 해결하고자 한다.#Review#Computer-Use Agent#Reinforcement Learning#Synthetic Environments#Co-evolution Loop#Grounded Grading#Agentic Workflow2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers본 논문은 Token-intensive 환경에서 고해상도 이미지 및 긴 영상 데이터를 처리할 때 발생하는 Diffusion Transformer의 연산 및 메모리 비효율 문제를 해결하고자 한다. 기존의 Full Attention 구조는 시퀀스 길이에 따라 연산 비용이 제곱으로 증가하여 확장성에 한계가 있다.#Review#Diffusion Transformers#Hybrid Attention#Chinchilla Scaling#Mixture-of-Experts#Compute-Optimal#HeteroP2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Can Large Language Models Execute Parent Orders?본 논문은 대량 주문을 집행할 때 발생하는 비용을 줄이기 위해 기존 모델들이 가진 한계를 극복하고자 LLM의 활용 가능성을 탐구한다.#Review#Parent-Order Execution#Large Language Models#Algorithmic Trading#PACE#Hierarchical Framework#Market Microstructure2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Beyond Geometric Complementarity: Coherent Overlap in Sparse Mixture-of-Experts RoutingSparse Mixture-of-Experts (MoE) 모델에서 전문가들의 공동 선택은 흔히 '기하학적 보완성(geometric complementarity)'으로 설명되는데, 이는 선택된 전문가들이 서로 다른 표현 방향을 담당한다는 가정에 기반합니다 .#Review#Mixture-of-Experts#Sparse Routing#Expert Subspaces#Geometric Complementarity#Route Coherence2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Evaluation본 논문은 기존 RPA 평가 방식이 고정된 대화 히스토리를 기반으로 모델을 평가함으로써 발생하는 데이터 오염 및 정적 평가의 한계를 극복하기 위해 제안되었습니다.#Review#Role-Playing Agents (RPAs)#User Simulation#Personalized Evaluation#Interactive Evaluation#LLM Benchmarking2026년 7월 30일댓글 수 로딩 중
[논문리뷰] Beacon: Knowing When and How to Perform Agentic Visual Reasoning본 논문은 기존의 Agentic Visual Reasoning 모델들이 도구 사용의 효율성과 효과성 측면에서 한계를 지니고 있다는 점을 문제로 정의합니다 .#Review#Agentic Visual Reasoning#Multimodal Large Language Models#Reinforcement Learning#Mode Adaptiveness#Tool Effect#Code Generation#Adaptive Reward2026년 7월 30일댓글 수 로딩 중
[논문리뷰] BM25 Wins at Scale: A Scaling Study of Retrieval-Augmented Generation Paradigms본 논문은 RAG 패러다임들이 다양한 규모의 Corpus에서 어떻게 성능과 비용적으로 확장되는지에 대한 불확실성을 해결하고자 합니다. 기존 연구들은 대체로 고정된 크기의 Corpus에서 특정 패러다임만을 단독 평가하여, 실제 기업 환경과 같이 데이터가 지속적으로 증가하는 상황에서의 확장성을 파악하기 어려웠습니다 .#Review#Retrieval-Augmented Generation#Scaling Study#BM25#Agentic Retrieval#Graph-based RAG#EnterpriseRAG-Bench2026년 7월 30일댓글 수 로딩 중
[논문리뷰] AskChem: Claim-Centered Infrastructure for Chemistry Literature Synthesis본 논문은 화학 문헌 검색 시스템이 논문 리스트 중심의 정보를 제공함에 따라, 과학자와 AI 에이전트가 정보를 직접 수집하고 검증해야 하는 비효율성을 해결하고자 합니다 .#Review#Chemistry Informatics#Literature Synthesis#Claim-Centered#Evidence Graph#Faceted Taxonomy#Provenance#Large Language Models2026년 7월 30일댓글 수 로딩 중
[논문리뷰] AMRD: Adaptive Multi-Teacher Relational Distillation for Lightweight Speech Emotion Recognition본 논문은 실시간 On-device Speech Emotion Recognition(SER)을 위한 효율적인 경량화 모델 학습의 어려움을 해결하고자 합니다. 기존의 대규모 SSL 모델은 성능은 우수하지만 파라미터 규모가 커서 엣지 디바이스에 배포하기에는 실용적이지 않습니다.#Review#Speech Emotion Recognition#Knowledge Distillation#Multi-Teacher#Relational Distillation#Edge Computing#Adaptive Weighting2026년 7월 30일댓글 수 로딩 중
[논문리뷰] AI Tour Meeting: Group Travel Planning by LLM Agents본 논문은 다수의 인간이 복잡한 선호도를 조율해야 하는 그룹 여행 계획 수립 과정을 모의하기 위한 전문적인 LLM-based multi-agent 시뮬레이션 프레임워크의 필요성을 제기합니다.#Review#LLM Agents#Group Travel Planning#Multi-Agent Simulation#Consensus Building#Persona-based Simulation#Framework2026년 7월 30일댓글 수 로딩 중
[논문리뷰] ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine본 연구는 Embodied AI 모델 학습에 필수적인 고품질의 Human-Centric 데이터가 절대적으로 부족하다는 문제를 해결하고자 한다. 기존의 데이터셋은 제한된 환경에서 수집되거나 인위적인 환경 설정으로 인해 실제 일상 생활의 복잡성과 자연스러운 상호작용을 충분히 반영하지 못하는 한계가 있다.#Review#Embodied AI#Data Engine#Human-Centric#Ambient Capture#Action Trajectory#Multimodal Dataset2026년 7월 30일댓글 수 로딩 중
[flashinfer] FlashInfer, MoE 모델의 성능을 극적으로 향상시키는 융합 커널과 최적화된 스케줄러 도입FlashInfer가 MoE 모델의 FC1 연산을 융합 커널로 최적화하고, 워프 협력 스케줄러를 도입하여 성능을 크게 향상시켰습니다.#AI#딥러닝#최적화#GPU#FlashInfer#MoE#FP8#MXFP8#CUDA2026년 7월 29일댓글 수 로딩 중
[transformers] Hugging Face Transformers: NoRepeatNGramLogitsProcessor 벡터화 및 성능 최적화NoRepeatNGramLogitsProcessor의 파이썬 루프와 호스트 동기화를 제거하고 텐서 연산으로 벡터화하여 성능을 대폭 개선했습니다.#HuggingFace#Transformers#Optimization#PyTorch#Performance2026년 7월 29일댓글 수 로딩 중
[vllm] [vLLM 분석] Speculative Decoding 성능 최적화: DSpark Markov Head 복제 전략TP 환경에서 작은 레이어의 샤딩으로 인한 통신 오버헤드를 제거하여 추론 속도를 최대 3.8% 향상시킨 기법을 살펴봅니다.#vLLM#Speculative Decoding#Tensor Parallelism#Performance Optimization#Deep Learning2026년 7월 29일댓글 수 로딩 중