[논문리뷰] Learn What's Left, Not What's Mastered: Saturation Aware Advantage Reweighting for Multi-Reward Policy Optimization본 논문은 다중 Reward Objective를 최적화할 때 발생하는 Reward-resolution loss와 불균형한 최적화 우선순위 문제를 해결하고자 합니다.#Review#Reinforcement Learning#Multi-Reward Optimization#Policy Optimization#Language Model Alignment#Saturation Aware Reweighting#Group Relative Policy Optimization2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Large Discovery Models: Empirically-grounded Model-Based Open-Ended Search본 논문은 과학적 발견(Scientific Discovery) 문제에서 LLM이 가진 한계를 극복하기 위해 Large Discovery Model (LDM)을 제안한다. 기존의 LLM 기반 연구 시스템은 제안된 후보의 과학적 유효성을 직접 평가하거나 신뢰할 수 있는 실험적 근거를 제공하는 데 한계가 있다.#Review#Large Discovery Models#Bayesian Optimization#Scientific Discovery#Inference-time Search#Uncertainty-aware Value#Empirically-grounded#Generative Foundation Model2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Improving the matrix multiplication exponent with modern optimization and AlphaEvolve본 논문은 행렬 곱셈의 복잡도를 결정하는 핵심 지수인 $\omega$의 최상단(SOTA)을 개선하는 문제를 다룹니다.#Review#Matrix Multiplication Exponent#Laser Method#Combination Loss Analysis#AlphaEvolve#Non-convex Optimization#Sinkhorn-Knopp Algorithm2026년 8월 17일댓글 수 로딩 중
[논문리뷰] How Do Agents Fail on AutoResearch: End-to-End Diagnostic Evaluation on 100 Real-World Frontier Research Tasks본 논문은 현재의 AutoResearch 에이전트가 연구 과정에서 어떻게 작동하고 어디서 실패하는지에 대한 체계적인 진단이 부재하다는 문제를 해결하고자 한다.#Review#AutoResearch#Agentic Scaffolds#Failure Taxonomy#Metacognitive Loop#Agent-as-a-Judge#Diagnostic Evaluation2026년 8월 17일댓글 수 로딩 중
[논문리뷰] HiFi-BRep: High-Fidelity Latent Representation for Robust B-Rep Generation본 논문은 기존의 B-Rep 생성 모델들이 가진 구조적 취약성을 해결하고, 고충실도 및 기하학적/토폴로지적으로 유효한 B-Rep을 생성하는 프레임워크를 제안한다.#Review#B-Rep Generation#Topology-Aware Encoder#Single-Stage Decoder#Manifold Constraints#High-Fidelity Latent Representation#CAD2026년 8월 17일댓글 수 로딩 중
[논문리뷰] HarnessEval-W: Agentifying the Evaluation of Visual Worlds본 논문은 기존의 월드 모델 평가 방식이 지닌 불투명성과 정적인 루브릭의 한계를 극복하기 위해 제안되었습니다 . 기존 벤치마크는 평가 과정이 블랙박스처럼 작동하여, 모델이 왜 특정 점수를 받았는지에 대한 근거를 제시하지 못하는 문제가 있습니다.#Review#World Models#Agentic Evaluation#Visual Worlds#Benchmark#Video Generation#Interactive Simulation#Evidence Tree2026년 8월 17일댓글 수 로딩 중
[논문리뷰] GenRouter: Unified Workflow Routing for Agentic Image Generation본 논문은 최신 Agentic Image Generation 시스템들이 겪고 있는 파편화와 컴퓨팅 자원의 비효율적 사용 문제를 해결하기 위해 고안되었습니다.#Review#Agentic Image Generation#Workflow Routing#Unified Framework#Compute-Mismatch#Self-Evolving System#GenCanvas#GenRouter2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Gathered, Not Admitted: How Attention Brings a Latent Variable into Verbalizable Form본 논문은 언어 모델이 잠재 변수(Latent Variable)를 어떻게 처리하여 '언어로 표현 가능한(Verbalizable)' 형태로 만드는가에 대한 메커니즘을 규명합니다.#Review#Language Models#Latent Variables#Attention Mechanism#Mechanistic Interpretability#Jacobian Lens#Causal Patching2026년 8월 17일댓글 수 로딩 중
[논문리뷰] GRNEdit: Efficient General Video Editing from a New Binary-Evidence Perspective in Generative Refinement Networks기존의 Instruction-based 비디오 편집 연구들은 거대 확산 모델이나 흐름 모델 위에서 복잡한 소스 컨디셔닝을 수행하여, 편집 의도를 반영하는 과정에서 연산 자원이 과도하게 소모되는 한계가 있습니다.#Review#Generative Refinement Networks#Video Editing#Binary Evidence#Hierarchical Binary Quantization#Identity-Aligned Null Condition#Instruction-Based Editing#Parameter-Efficient2026년 8월 17일댓글 수 로딩 중
[논문리뷰] ENTLORE: A Graph-Grounded Benchmark for Latent Organizational Reasoning in Enterprise Question Answering본 논문은 기존 엔터프라이즈 QA 벤치마크가 단순 사실 정보의 검색 및 조합에만 치중하여, 기업 환경에서 필수적인 '잠재적 조직 관계 추론' 역량을 측정하지 못한다는 문제를 지적합니다 .#Review#Enterprise QA#Latent Organizational Reasoning#Graph-Grounded Benchmark#Information Retrieval#RAG#Knowledge Graphs2026년 8월 17일댓글 수 로딩 중
[논문리뷰] DumpsterCluster: From Dumpster Diving to Serving LLaMA-70B on $60 GPUs본 논문은 최신 GPU의 높은 구매 비용과 빠른 하드웨어 교체 주기로 인해 발생하는 경제적·환경적 비효율성을 해결하기 위해 폐기된 하드웨어의 재활용 가능성을 탐구한다.#Review#DumpsterCluster#GPU Repurposing#LLM Inference#Pipeline Parallelism#Circular Economy#Cost-Effectiveness#Operational Carbon2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Drive, Pack, Fly: The Travelling Thief Problem with Drone본 논문은 적재량에 따라 차량 속도가 감소하는 현실적인 물류 수거 환경에서 드론과의 협업을 통한 최적화 문제를 해결하고자 한다. 기존 연구들은 단순한 배달 경로 최적화에 집중하거나, Travelling Thief Problem의 비선형적인 부하 의존성을 분리해서 다루는 한계가 있었다.#Review#Combinatorial optimisation#Travelling thief problem#Drone routing#Reinforcement learning#Mixed-integer programming2026년 8월 17일댓글 수 로딩 중
[논문리뷰] ConceptFormer: Learning Adaptive Latent Concepts for Query-Document Alignment in Visual Document Retrieval본 논문은 시각적 문서 검색에서 쿼리와 문서 간의 미세한 연관성을 포착하는 데 기존 방식이 가진 한계를 해결하고자 한다 .#Review#Visual Document Retrieval#Representation Learning#Vision-Language Models#Latent Concept Learning#Multimodal Retrieval-Augmented Generation2026년 8월 17일댓글 수 로딩 중
[논문리뷰] ClawGym II: Exploring Black-Box RL on Agent Harness본 논문은 복잡한 Agent Harness 환경에서 범용 에이전트를 안정적이고 확장 가능하게 최적화하는 Black-Box RL 프레임워크를 제안합니다.#Review#Black-Box RL#Agent Harness#Policy Optimization#Prefix Tree#Reinforcement Learning#Scalable Infrastructure2026년 8월 17일댓글 수 로딩 중
[논문리뷰] AnyTalk: Speech Animation for Arbitrary Characters Leveraging a Video Generation Model본 논문은 오디오 기반 3D 얼굴 애니메이션 생성 시 발생하는 높은 데이터 의존성과 캐릭터 제약 문제를 해결하기 위해 제안되었다. 기존 연구들은 각 캐릭터의 고유한 메시 구조나 Blendshape 구성에 맞춘 쌍(Pair) 형태의 학습 데이터를 요구하며, 이는 소규모 스튜디오나 독립 개발자에게 큰 기술적 장벽이 된다 .#Review#Audio-driven animation#Facial animation#Diffusion model#Character-specific Fine-tuning#Blendshape optimization2026년 8월 17일댓글 수 로딩 중
[논문리뷰] An Empirical Study of Training Pixel-Space Text-to-Image Diffusion Models본 논문은 대규모 환경에서 Pixel-Space Diffusion 모델이 Latent-Space 모델에 비해 학습 효율성이 떨어진다는 핵심 문제를 해결하고자 합니다. 기존 Latent-Space 모델은 VAE의 압축으로 인해 정보 손실이 발생하고 디코딩 지연(Latency)이 추가되는 한계가 있습니다.#Review#Pixel-Space Diffusion#Latent-to-Pixel Transition#Diffusion Transformer#Large-Scale Pre-training#Inference Efficiency#Step Distillation2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Agentic Transaction: Towards ACID-Compliant Agent Systems본 논문은 LLM 에이전트가 복잡한 프로덕션 작업으로 진화함에 따라 발생하는 실행 신뢰성, 일관성, 동시성 제어 문제를 해결하고자 합니다.#Review#Agentic Transaction#ACID-Compliant#Semantic Atomicity#Semantic Consistency#Semantic Isolation#Semantic Durability#LLM Agents2026년 8월 17일댓글 수 로딩 중
[논문리뷰] Advancing Open and Reproducible Relational Learning: RelArena-α, TabPFN-Rel and RPI본 논문은 현재 Relational learning 분야가 직면한 재현성 저하와 모델 간 비교의 어려움을 해결하기 위해 RelArena-α, TabPFN-Rel, RPI를 제안한다.#Review#Relational Learning#Reproducibility#RelArena#TabPFN#Relational Benchmarking#AutoML#RPI2026년 8월 17일댓글 수 로딩 중
[논문리뷰] A Plug-and-Play 2D Motion Interface for Real-World Motion Language Models본 연구는 기존 MLMs가 생성 결과에 대한 정밀한 공간적 제어가 어렵다는 점을 해결하고자 합니다. 대부분의 MLMs는 텍스트 프롬프트에 의존하여 모션을 생성하므로, 사용자가 원하는 구체적인 이동 경로를 반영하는 데 한계가 있습니다.#Review#Motion Language Models#Motion Generation#2D Motion Interface#Trajectory Control#Plug-and-Play#Motion Editing2026년 8월 17일댓글 수 로딩 중
[cpython] CPython 성능 최적화: re.split의 리스트 빌드 과정 개선하기CPython의 re.split 구현에서 _PyList_AppendTakeRef를 사용하여 불필요한 참조 카운트 조작을 제거하고 성능을 향상시킨 사례를 분석합니다.#CPython#Python#Performance#Optimization#Internals2026년 8월 17일댓글 수 로딩 중