[vllm] vLLM Qwen3.8-Flash-Next: QSA Indexer 캐시를 위한 FP8 지원으로 메모리 효율 및 성능 최적화vLLM의 QSA Indexer 캐시에 FP8 지원을 추가하여 메모리 사용량을 줄이고 성능을 향상시키는 PR 분석.#vLLM#FP8#Quantization#LLM Optimization#QSA#Performance#Memory Efficiency#PyTorch2026년 9월 7일댓글 수 로딩 중