[논문리뷰] Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation본 논문은 기존 Text-to-Image (T2I) 모델이 실세계의 복잡하고 모호한 요청을 처리하는 데 겪는 구조적 한계를 해결하고자 합니다. T2I 모델은 일반적으로 완전히 명시된 프롬프트에 최적화되어 있으나, 실세계의 사용자 요청은 불완전하거나 맥락 정보를 필요로 하는 경우가 많습니다 .#Review#Agentic Image Generation#Context Gap#Context-Aware Planning#Context Grounding#IA-Bench#Multimodal Large Language Model (MLLM)2026년 6월 25일댓글 수 로딩 중
[논문리뷰] GenClaw: Code-Driven Agentic Image Generation본 논문은 기존의 end-to-end 방식의 image generation 모델이 겪는 제어 가능성 및 추론 능력의 한계를 해결하고자 합니다. 기존 모델들은 프롬프트 재작성을 통해 반복적인 '블랙박스' 식 시행착오를 거치며, 복잡한 공간 관계나 텍스트 레이아웃을 정밀하게 제어하는 데 실패하는 경우가 많습니다 .#Review#Agentic Image Generation#Code-Driven#SVG#Multimodal Reasoning#Layered Representation#Controllable Generation2026년 5월 28일댓글 수 로딩 중