[논문리뷰] Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges본 논문은 현대 MLLM(Multimodal Large Language Models)이 이미지 캡셔닝이나 시각적 질의응답(VQA) 등 명시적 인식 능력은 뛰어나지만, 유머와 같이 비유적 의미와 문화적 맥락이 개입된 콘텐츠 이해에는 여전히 구조적 한계를 보인다는 점을 문제로 제기한다.#Review#Multimodal LLMs#Computational Humor#Visual Reasoning#Incongruity#Creative Generation#Task Hierarchy2026년 7월 21일댓글 수 로딩 중