[논문리뷰] FoldingAgent: Inferring Parametric Origami Procedures from Demonstration Videos본 논문은 인간의 직관적인 종이 접기 비디오와 기계 해석을 위한 구조적 표현 사이의 근본적인 의미론적 격차(Semantic gap)를 해소하기 위해 제안되었다. 기존 연구들은 주로 정적인 Crease Pattern을 입력으로 요구하지만, 실제 사용자들은 주로 비구조적인 비디오 데모를 통해 지식을 공유한다.#Review#Origami#Vision-Language Model#Agentic Framework#Procedural Inference#PurelandFold#Parametric Representation#Physical Simulation2026년 9월 2일댓글 수 로딩 중
[논문리뷰] Weaving Visual Narratives: Agentic Image Bundle Composition Beyond Atomic Visual Matching본 논문은 전통적인 Atomic Visual Matching 패러다임이 인간의 복합적인 검색 의도를 반영하지 못하는 한계를 해결하고자 한다.#Review#Image Bundle Composition#Agentic Framework#Hyperedge Discovery#Multimodal Retrieval#Visual Narratives#VLM2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Procedura: Agentic 3D Modeling with Procedural Control기존의 Native 3D generators는 고품질 메시를 생성할 수 있으나, 정교한 기계적 구조를 표현하는 데 한계가 있으며, 생성된 결과물이 부품 단위로 분해되지 않거나 편집이 불가능하다는 문제점이 있습니다.#Review#3D Modeling#Agentic Framework#Procedural Assembly#CSG#Large Language Models#Typed Mates#Parametric Program2026년 8월 27일댓글 수 로딩 중
[논문리뷰] StateFlow: Building, Evolving, and Accessing 3D World States for Previsualization본 논문은 기존의 one-shot generative model이 가진 고질적인 편집 불가능성과 공간적 일관성 결여 문제를 해결하기 위해 StateFlow를 제안합니다.#Review#Previsualization#3D World State#Generative AI#Scene Generation#Camera Planning#State Evolution#Agentic Framework2026년 8월 12일댓글 수 로딩 중
[논문리뷰] Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence본 논문은 AI 모델의 지능적 역량과 잠재적 위험을 규명하는 기제적 이해(Mechanistic Understanding)가 모델의 발전 속도를 따라가지 못하는 격차 문제를 해결하고자 합니다.#Review#Mechanistic Interpretability#Agentic Framework#Belief-state Reasoning#Scientific Discovery#Causal Intervention#Subliminal Learning2026년 8월 12일댓글 수 로딩 중
[논문리뷰] WorldClaw: Agentic 3D Open-World Generation at Scale본 논문은 대규모의 자유로운 탐색이 가능한 3D 월드를 생성할 때 발생하는 글로벌 공간 일관성과 로컬 콘텐츠 디테일 사이의 충돌 문제를 해결하고자 합니다 .#Review#3D Scene Generation#Agentic Framework#Procedural Terrain Generation#Open-World#Coarse-to-Fine#Multi-Modal LLM2026년 8월 6일댓글 수 로딩 중
[논문리뷰] MapAgent: An Industrial-Grade Agentic Framework for City-scale Lane-level Map Generation본 연구는 고정밀 Lane-level Map의 자동 생성 및 유지보수 과정에서 발생하는 사양 준수 오류를 해결하기 위한 Agentic Framework를 제안한다.#Review#Map Generation#Map Agent#Vision-Language Models#Lane-level Mapping#Agentic Framework#Vectorization#Constraint Verification2026년 6월 3일댓글 수 로딩 중
[논문리뷰] ORACLE: Anticipating Scams from Partial Trajectories in Streaming App Usage본 논문은 현대의 스마트폰 사기가 단일 앱 내의 메시지 분석만으로는 탐지하기 어려운 다단계, 교차 앱(Cross-app) 형태의 복합적인 과정을 거친다는 문제점에서 출발합니다 .#Review#Scam Anticipation#Streaming App Usage#Agentic Framework#Self-Evolving Context Manager#On-Policy Self-Distillation#Cross-temporal Reasoning#Long-horizon Benchmark2026년 5월 28일댓글 수 로딩 중
[논문리뷰] Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search본 논문은 LLM이 생성한 Lean 4 증명이 정답은 맞추지만, 지나치게 장황하고 특정 버전의 라이브러리에 취약하다는 점을 해결하고자 합니다 .#Review#Lean 4#Proof Optimization#Agentic Framework#Retrieval-Augmented Generation#Multi-Objective Optimization#Formal Verification2026년 5월 21일댓글 수 로딩 중
[논문리뷰] IndusAgent: Reinforcing Open-Vocabulary Industrial Anomaly Detection with Agentic Tools본 논문은 MLLM의 강력한 제로샷 성능에도 불구하고, 고도의 정밀함이 요구되는 산업 환경에서 도메인 불일치 및 구조적 환각(structural hallucination)으로 인해 발생하는 이상 탐지 성능 저하 문제를 해결합니다 .#Review#Industrial Anomaly Detection#Multimodal Large Language Models#Agentic Framework#Reinforcement Learning#Tool Augmentation#Zero-shot Learning2026년 5월 20일댓글 수 로딩 중
[논문리뷰] Nexus : An Agentic Framework for Time Series Forecasting본 논문은 기존 TSFM과 LLM 기반 시계열 예측 연구가 가진 구조적 한계를 해결하기 위해 Nexus를 제안한다.#Review#Time Series Forecasting#Large Language Models#Agentic Framework#Multimodal#Reasoning#Temporal Dynamics#Calibration2026년 5월 14일댓글 수 로딩 중
[논문리뷰] SCOPE: Structured Decomposition and Conditional Skill Orchestration for Complex Image Generation본 논문은 복잡한 visual intent를 충족해야 하는 최신 text-to-image 생성 모델들이 겪는 semantic commitment의 단절 문제, 즉 Conceptual Rift를 해결하고자 합니다.#Review#Text-to-Image Generation#Agentic Framework#Semantic Commitments#Structured Specification#Skill Orchestration#Gen-Arena2026년 5월 10일댓글 수 로딩 중
[논문리뷰] VLAA-GUI: Knowing When to Stop, Recover, and Search, A Modular Framework for GUI Automation본 논문은 자율형 GUI 에이전트가 직면한 early stopping과 repetitive loops라는 두 가지 근본적인 문제를 해결하기 위해 VLAA-GUI를 제안합니다. 기존 에이전트들은 작업 완료 여부를 불명확하게 판단하여 미완성 상태에서 성공을 선언하거나, 동일한 실패 행동을 반복적으로 수행하는 한계를 보입니다.#Review#GUI Automation#Agentic Framework#Completeness Verifier#Loop Breaker#Search Agent#Multimodal LLM2026년 4월 23일댓글 수 로딩 중
[논문리뷰] AutoMIA: Improved Baselines for Membership Inference Attack via Agentic Self-Exploration본 논문은 기존 MIA가 의존하는 정적인 핸드크래프트 휴리스틱의 낮은 적응성과 확장성 문제를 해결하기 위해 에이전트 기반의 자동화된 공격 프레임워크를 제안합니다.#Review#Membership Inference Attack#Agentic Framework#Strategy Self-Exploration#Large Vision-Language Models#Privacy Auditing2026년 4월 2일댓글 수 로딩 중
[논문리뷰] Think, Act, Build: An Agentic Framework with Vision Language Models for Zero-Shot 3D Visual Grounding본 논문은 3D-VG 작업을 'Think(추론)', 'Act(도구 호출)', 'Build(재구성)' 단계로 세분화한 TAB 프레임워크를 제안합니다 . TAB은 고정된 파이프라인 대신, 전문적인 3D-VG Skill blueprint에 따라 VLM 에이전트가 능동적으로 visual tool을 호출하여 타겟을 추적하고 마스크를 생성합니다.#Review#3D Visual Grounding#Vision-Language Models#Agentic Framework#RGB-D#Zero-Shot#Geometric Reconstruction2026년 4월 1일댓글 수 로딩 중
[논문리뷰] Towards a Medical AI Scientist기존의 AI Scientist 프레임워크들은 수학이나 화학 등 일반적인 데이터와 프로토콜이 표준화된 영역에서 성과를 보였으나, 임상 의학 분야에 적용하는 데에는 한계가 있었습니다.#Review#Medical AI Scientist#Autonomous Scientific Discovery#Agentic Framework#Clinician-Engineer Co-reasoning#Med-AI Bench#Clinical Evidence Grounding2026년 3월 30일댓글 수 로딩 중
[논문리뷰] SAGE: Scalable Agentic 3D Scene Generation for Embodied AI본 논문은 Embodied AI 의 고비용 및 안전 문제로 인한 데이터 수집의 한계를 극복하고, 기존 장면 생성 시스템의 물리적 비유효성 및 비현실성 문제를 해결하고자 합니다.#Review#Embodied AI#3D Scene Generation#Agentic Framework#Simulation-Ready Environments#Robot Policy Learning#Large Language Models (LLM)#Physics Simulation#Data Augmentation2026년 2월 10일댓글 수 로딩 중
[논문리뷰] AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations과학 논문의 복잡한 내용을 효과적으로 시각화하는 고품질 삽화의 수동 생성 병목 현상을 해결하고자 합니다. 특히, 긴 과학 텍스트(long-form scientific texts)로부터 출판 준비 수준의 과학 삽화를 자동으로 생성 및 개선 하는 것을 목표로 합니다.#Review#Scientific Illustration Generation#Long-form Text-to-Image#Agentic Framework#Reasoned Rendering#Layout Planning#Text Refinement#FigureBench#VLM-as-a-judge2026년 2월 4일댓글 수 로딩 중
[논문리뷰] PaperBanana: Automating Academic Illustration for AI ScientistsAI 과학자들을 위한 학술 출판용 일러스트레이션(방법론 다이어그램 및 통계 플롯) 생성 과정의 노동 집약적인 병목 현상을 해소하고 자동화하는 것을 목표로 합니다. 이를 통해 연구 워크플로우를 가속화하고 높은 품질의 시각적 커뮤니케이션 도구에 대한 접근성을 민주화하고자 합니다.#Review#Automated Illustration Generation#Agentic Framework#Vision-Language Model#Image Generation#Methodology Diagrams#Statistical Plots#Academic Publishing#Iterative Refinement2026년 2월 1일댓글 수 로딩 중
[논문리뷰] SlideTailor: Personalized Presentation Slide Generation for Scientific Papers이 논문은 기존 자동 슬라이드 생성 시스템이 사용자 선호도를 충분히 반영하지 못하여 만족스럽지 못한 결과물을 초래하는 문제를 해결하고자 합니다.#Review#Personalized Slide Generation#Preference Learning#Large Language Models#Multimodal AI#Chain-of-Speech#Agentic Framework#Document-to-Slides2025년 12월 28일댓글 수 로딩 중
[논문리뷰] WebVIA: A Web-based Vision-Language Agentic Framework for Interactive and Verifiable UI-to-Code Generation본 논문은 기존 Vision-Language Models (VLMs) 기반의 UI-to-Code 접근 방식이 정적인 HTML/CSS 코드만 생성하고 GUI 상호작용을 지원하지 못하는 한계를 극복하고자 합니다.#Review#UI-to-Code#Vision-Language Models#Agentic Framework#Interactive UI#Web Automation#Code Generation#UI Verification#Supervised Fine-Tuning2025년 11월 12일댓글 수 로딩 중
[논문리뷰] VLA^2: Empowering Vision-Language-Action Models with an Agentic Framework for Unseen Concept Manipulation본 논문은 기존 VLA 모델이 훈련 데이터 외부의 미확인 객체 개념(unseen concepts) 에 직면했을 때 급격히 성능이 저하되는 문제, 즉 OOD(Out-of-Distribution) 일반화 실패를 해결하는 것을 목표로 합니다.#Review#Vision-Language-Action Models#Agentic Framework#Unseen Concept Manipulation#Out-of-Distribution Generalization#Tool Use#Web Retrieval#Object Detection#LIBERO Simulation2025년 10월 17일댓글 수 로딩 중
[논문리뷰] SceneWeaver: All-in-One 3D Scene Synthesis with an Extensible and Self-Reflective Agent이 논문은 기존 3D 장면 합성 방법론들이 고정된 카테고리, 부족한 객체 디테일, 물리적 불일치, 복잡한 사용자 지시와의 낮은 정합성 등의 한계를 가지는 문제를 해결하고자 합니다.#Review#3D Scene Synthesis#Agentic Framework#LLMs#Self-Reflection#Tool-Use#Physical Plausibility#Iterative Refinement#Embodied AI2025년 9월 26일댓글 수 로딩 중