[논문리뷰] HyQuant: Hybrid-Precision Quantization for LLM Attention본 논문은 LLM attention module의 low-bit quantization이 end-to-end model quality를 저하시키는 문제를 해결하고자 합니다.#Review#LLM#Quantization#Attention Mechanism#Hybrid Precision#KV Cache#Long-Context Inference#Vertical-Line Tokens2026년 9월 10일댓글 수 로딩 중