[논문리뷰] DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution기존 비디오 생성 모델들은 시각적 충실도와 모션 품질에서 상당한 발전을 이루었지만, 오디오를 생략하거나 별도의 단계에서 합성하는 경우가 많아 시각적 역동성과 음향 이벤트 간의 상호 모델링이 제한적이라는 핵심적인 문제에 직면해 있다.#Review#Native Audio-Video Generation#Gated Cross-Modal Attention#Reinforcement Learning#2K Refinement#Open-Weight Model#Multimodal Feedback2026년 8월 31일댓글 수 로딩 중
[논문리뷰] Aligning Text, Code, and Vision: A Multi-Objective Reinforcement Learning Framework for Text-to-Visualization기존 Text-to-Visualization (Text2Vis) 시스템, 특히 오픈소스 LLM 들이 쿼리와 의미적으로 정렬되고 가독성이 높으며 실행 가능한 시각화를 생성하는 데 어려움을 겪는 문제를 해결하는 것이 목표입니다.#Review#Text-to-Visualization#Reinforcement Learning#Multi-Objective Optimization#GRPO#Multimodal Feedback#LLMs#Code Generation2026년 1월 13일댓글 수 로딩 중