본문으로 건너뛰기

Review

[논문리뷰] Two-Level Meta-Rubrics for Evaluating Open-Ended Generation: GAMUT, a Benchmark for Factual Completeness

댓글 수 로딩 중

[논문리뷰] Trajectory-aware Cross-view Geo-localization with Sequential Observations

댓글 수 로딩 중

[논문리뷰] EduPanel: A Three-Agent LLM Judge for Teaching Videos -- Reliability, Complementarity, and Human Trust Calibration

댓글 수 로딩 중

[논문리뷰] Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges

댓글 수 로딩 중