[논문리뷰] OmniDelta: Skill-Driven Budget Allocation for Token Compression in OmniLLMs본 논문은 OmniLLM의 긴 오디오-비디오 토큰 시퀀스로 인한 높은 Latency와 메모리 비용 문제를 해결하기 위해, 기존의 고정된 토큰 예산 할당 방식의 한계를 지적합니다 .#Review#OmniLLM#Token Compression#Budget Allocation#Skill-Driven#Multimodal Inference#Efficiency#Token Pruning2026년 7월 28일댓글 수 로딩 중