[논문리뷰] VoxMem: Benchmarking Multimodal Memory in Large Audio Language Models음성 기반 대화 시스템은 이전 상호작용(즉, 메모리)에서 정보를 회수하는 능력이 필수적이지만, 현재 LALMs의 multimodal memory 능력은 충분히 평가되지 않고 있습니다.#Review#Large Audio Language Models (LALMs)#Multimodal Memory#Spoken Conversational Memory#Acoustic Evidence#Memory Operations#Multi-session Histories#Benchmark#Context Length2026년 9월 29일댓글 수 로딩 중