[논문리뷰] LLaDA-UI: Bringing Block-wise Diffusion to Vision-Language GUI Agents기존 autoregressive (AR) 패러다임의 멀티모달 대규모 언어 모델(Large Language Models, LLMs)은 내재적인 순차적(sequential) 특성으로 인해 병렬화(parallelism)가 제한되고 상당한 추론 Latency를 발생시켜, 실시간성이 중요한 GUI Agent 애플리케이션에는 비효율적이다.#Review#Diffusion Language Models#GUI Agents#Vision-Language Models#Block-wise Diffusion#Multimodal Pre-training#Supervised Fine-tuning#Inference Efficiency2026년 9월 14일댓글 수 로딩 중