[논문리뷰] VideoGAIA: A Benchmark for General AI Assistants on Agentic Video Understanding본 논문은 기존의 단일 턴(Single-turn) 방식 비디오 이해 벤치마크가 포화 상태에 이르렀으며, 복합적인 실세계 문제를 해결하는 능력을 평가하기에 부족하다는 점을 지적합니다. 기존 벤치마크에서는 최신 MLLMs가 90%에 육박하는 정확도를 보이며 성능 정체를 겪고 있습니다 .#Review#Multimodal Large Language Models#Video Understanding#Agentic AI#Tool-Augmented Interaction#Benchmark#Evidence-Grounded Reasoning2026년 8월 17일댓글 수 로딩 중