[논문리뷰] SQS: Bayesian DNN Compression through Sparse Quantized Sub-distributions본 연구는 대규모 신경망의 추론 비용을 줄이기 위한 기존 pruning과 quantization 기법들이 서로 독립적으로 수행될 때 발생하는 성능 저하 문제를 해결하고자 합니다.#Review#DNN Compression#Bayesian Variational Learning#Weight Pruning#Low-bit Quantization#Spike-and-Slab Prior#Gaussian Mixture Models#Outlier-aware Windowing2026년 9월 8일댓글 수 로딩 중