[논문리뷰] AutoDesign: Meta-Harness Optimization for Long-Horizon Agentic Design본 논문은 복잡한 multimodal 소스를 구조화된 결과물로 변환하는 long-horizon agentic 프로세스의 정적(static)인 한계를 해결하고자 합니다. 기존 시스템은 반복적인 생성과 수정 과정에서 발생하는 피드백을 일회성 신호로 처리하며, 재사용 가능한 설계 지식으로 축적하지 못합니다 .#Review#Agentic Design#Meta-Harness Optimization#Long-Horizon Reasoning#PosterBench#DesignHarness#Self-Refinement#Multimodal Generation2026년 8월 13일댓글 수 로딩 중
[논문리뷰] Are You Sure You're Sure? On the Impact of Instruction Tuning on Confidence and Lexical Diversity본 논문은 Instruction Tuning이 모델의 verbalized overconfidence를 유발한다는 기존 연구에 주목하여, 이러한 confidence의 변화가 생성된 근거(Rationale)의 어휘적 다양성과 어떤 상관관계가 있는지 규명하고자 한다.#Review#Instruction Tuning#Model Confidence#Lexical Diversity#Question Answering#Calibration#Rationale#Uncertainty Estimation2026년 8월 13일댓글 수 로딩 중
[논문리뷰] An AI4AI Framework for Visual Token Pruning본 논문은 MLLM의 추론 성능을 저하시키지 않으면서 visual token 수를 효율적으로 줄이기 위한 자동화된 알고리즘 설계의 어려움을 해결하고자 합니다.#Review#Multimodal Large Language Models#Visual Token Pruning#Large Language Model Driven#Domain-Specific Language#Residual Search#Inference Optimization2026년 8월 13일댓글 수 로딩 중
[논문리뷰] Alaya-EVOKE: From Linear-Scaling Supervision to Endless World본 논문은 대화형 세계 모델(Interactive World Models)이 직면한 persistent memory, 반응성, 긴 생성 시간이라는 세 가지 상충하는 요구사항을 해결하는 것을 목표로 한다.#Review#Interactive World Models#Long-Horizon Generation#Geometric World State#Bounded Recurrent Process#Sparse Attention#Distribution Matching2026년 8월 13일댓글 수 로딩 중
[논문리뷰] AVA-Encoder: Towards Agent-Native Video Representation Learning본 논문은 비디오 생성 에이전트가 고품질의 영화 콘텐츠를 학습하고 재현하는 데 필요한 구조화된 표현이 부족하다는 문제를 해결한다. 기존의 낮은 수준의 시각적 표현(픽셀, 임베딩)은 에이전트의 해석과 조작이 어렵고, 단순 캡션 기반의 표현은 영화의 복잡한 구조와 세부 정보를 유지하지 못하는 한계가 있다.#Review#Agentic Video Encoder#Knowledge Graph Representation#Textual-Gradient#Self-Evolving Framework#Video Auto-Encoding#Cinematic Fidelity2026년 8월 13일댓글 수 로딩 중
[논문리뷰] ToolHazard: Scaling Adversarial Environments for Security Evaluation and Alignment of LLM-based Agents본 논문은 기존의 Agent 보안 연구가 수동으로 구현된 환경에 의존하여 확장성이 낮고, LLM 기반 도구 시뮬레이션의 확률적 성격으로 인해 재현 가능한 평가가 어렵다는 문제를 해결한다.#Review#LLM Agents#Indirect Prompt Injection#Adversarial Environment#Safety Alignment#Tool-use#Benchmarking2026년 8월 12일댓글 수 로딩 중
[논문리뷰] The Illusion of Visual Tool-Use: A Causal Audit of Thinking with Images본 논문은 'thinking-with-images' 패러다임을 사용하는 MLLM이 기대와 달리 직관적인 성능 향상을 보여주지 못하거나, 불필요한 연산으로 자원을 낭비하는 문제를 해결하고자 한다.#Review#Multimodal Large Language Models#Visual Tool-Use#Causal Inference#Policy Miscalibration#Thinking-with-Images#Visual Evidence Gain2026년 8월 12일댓글 수 로딩 중
[논문리뷰] StateFlow: Building, Evolving, and Accessing 3D World States for Previsualization본 논문은 기존의 one-shot generative model이 가진 고질적인 편집 불가능성과 공간적 일관성 결여 문제를 해결하기 위해 StateFlow를 제안합니다.#Review#Previsualization#3D World State#Generative AI#Scene Generation#Camera Planning#State Evolution#Agentic Framework2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill본 논문은 기존의 자율 연구 에이전트들이 별도의 독립적인 플랫폼과 복잡한 오케스트레이션 인프라를 필요로 하는 폐쇄적 구조라는 점에 주목하여, 이를 코딩 어시스턴트 내부의 재사용 가능한 스킬 형태로 구현하고자 한다.#Review#Autonomous Research Agents#Research Paper Generation#Composable Skills#Coding Assistants#Self-Critique#Evidence-Grounded Generation#Editable Figures2026년 8월 12일댓글 수 로딩 중
[논문리뷰] SkillZip: Contract-Preserving Graph Compression for Scalable Agent Skill Libraries본 논문은 LLM Agent의 스킬 라이브러리가 확장됨에 따라 발생하는 Procedural Knowledge의 중복성과 컨텍스트 예산 부족 문제를 해결하고자 합니다.#Review#LLM Agents#Agent Skills#Procedural Memory#Graph Compression#Skill Retrieval2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Simplex Relaxation for Discrete Diffusion본 논문은 기존 Uniform Discrete Diffusion 모델에서 범주형 corruption 과정을 유지하면서도 학습 목적함수와 역방향 샘플러의 성능을 고도화하는 것을 목표로 합니다. 기존 연구들은 역방향 업데이트를 순수하게 범주형 상태만으로 설계하여 학습 및 샘플링 과정의 제약이 컸습니다 .#Review#Discrete Diffusion#Categorical Generation#Simplex Relaxation#Dirichlet-Categorical Augmentation#Rao-Blackwellized#Generative Perplexity2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Self-Geometry: GT-Free and Plug-and-Play Test-Time Adaptation for Geometrically Consistent 3D Vision Foundation Models본 논문은 사전 학습된 VFMs가 훈련 과정에서 명시적인 다중 뷰 기하학적 일관성(multi-view geometric consistency)을 보장받지 못해 발생하는 불일치 문제를 해결하고자 합니다.#Review#Test-Time Adaptation#3D Vision Foundation Models#Geometric Consistency#Multi-View Reconstruction#LoRA#Epipolar Geometry2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Self-Evolving Embodied Agents via Skill-Harness Evolution본 논문은 Frozen 상태의 embodied agent가 새로운 환경에 직면했을 때 파라미터 업데이트 없이 효과적으로 적응할 수 있는 방법을 탐구합니다.#Review#Embodied Agents#Train-free Adaptation#Foundation Models#Skill Evolution#Harness Optimization#VLA#Rollout-guided Diagnosis2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Ready Cohorts: Bounding GPU Opportunity and Avoiding Host Round Trips in LLM-Agent Control본 논문은 LLM-agent 서비스의 결정론적 제어 경로(deterministic control path)가 빈번한 CPU-GPU 경계 이동으로 인해 시스템의 성능 병목을 유발하는 문제를 해결하고자 합니다.#Review#LLM-Agent#GPU Acceleration#Ready-Cohort Boundary#Host Round Trip#Agent Runtime#Deterministic Control2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop본 논문은 대규모 LLM agent 사회를 시뮬레이션하는 데 발생하는 과도한 계산 비용 문제를 해결하기 위해, 저비용의 Surrogate 모델링 기법을 제안합니다.#Review#LLM multi-agent systems#agent-based modelling#mean-field theory#finite-size scaling#surrogate models#behavioural cloning#sociophysics2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Persistent Recursive Worlds Enable Autonomous Software Evolution본 논문은 장기적인 소프트웨어 개발 과정에서 개별 agent의 수명이 시스템의 수명보다 짧음으로써 발생하는 '연속성 문제'를 해결하고자 합니다.#Review#Autonomous Software Evolution#Persistent Recursive Worlds#Recursive Delegation#LLM Agent#Software Engineering#Codebase Formation#Model-Agnostic2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Parameter Exploration for RLVR via Variational Learning본 논문은 RLVR 환경에서 발생하는 정책의 정체(Stall)와 탐색의 한계를 해결하기 위해 파라미터 공간에서의 탐색 기법을 제안합니다.#Review#RLVR#Parameter-Space Exploration#Variational Learning#IVON#GRPO#LLM Alignment#Chunked Noising2026년 8월 12일댓글 수 로딩 중
[논문리뷰] OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution본 논문은 현대의 AI 에이전트가 단발성 작업이 아닌 장기적인(Long-horizon) 워크플로우에서 동작함에 따라 발생하는 누적된 안전성 위협을 규명하고자 합니다 .#Review#Agent Safety#Red Teaming#Environment Evolution#Long-Horizon#Markov Hypergraph#Robustness2026년 8월 12일댓글 수 로딩 중
[논문리뷰] NeuPAT: Neuron-aware Plasticity Allocation Tuning for Language-Preserving MLLMs본 논문은 MLLM으로의 확장 과정에서 발생하는 언어 성능 저하 문제를 해결하기 위해, 사전 학습된 LLM 내부의 뉴런 단위 적응 역학을 조사합니다 . 기존의 Vanilla Tuning 방식은 모델 전체를 균일하게 학습시켜, 언어 처리에 필수적인 뉴런의 기능까지 불필요하게 훼손하는 문제를 야기합니다 .#Review#Multimodal Large Language Models#Language Preservation#Plasticity Allocation#Neuron-level Adaptation#Instruction Tuning2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence본 논문은 AI 모델의 지능적 역량과 잠재적 위험을 규명하는 기제적 이해(Mechanistic Understanding)가 모델의 발전 속도를 따라가지 못하는 격차 문제를 해결하고자 합니다.#Review#Mechanistic Interpretability#Agentic Framework#Belief-state Reasoning#Scientific Discovery#Causal Intervention#Subliminal Learning2026년 8월 12일댓글 수 로딩 중